Термос Беспалова
Скилл · Данные и ИИ

LLM Evaluation

Оценка качества ИИ-приложений: метрики, галлюцинации, регрессии.

О скилле

Что делает

Учит проверять, насколько правильно и стабильно отвечает ваш ИИ-агент или бот: наборы эталонных задач, метрики для систем поиска по документам, обнаружение выдуманных фактов, оценка качества ответов и сравнение вариантов промптов. Разработчику ИИ-продукта даёт объективные цифры вместо «кажется, работает», инженеру — автоматическую проверку на ухудшения.

llmevaluationragasaibenchmarkshallucination
Источник

Откуда скилл и как поставить

Автор и репозиторий

Автор — rmyndharis. Репозиторий собрал 881 звёзд на GitHub. Распространяется под лицензией MIT. Файл llm-evaluation.md открыт: прочитать его можно до установки.

Открыть репозиторий

Установка в Claude Code

Склонируйте репозиторий в ~/.claude/skills/ и перезапустите Claude Code — скилл подхватится сам. Дальше просто попросите ассистента использовать «LLM Evaluation».

Cursor и другие редакторы

Скопируйте содержимое SKILL.md в системные правила проекта. Скиллы не запускают код — это текстовые инструкции, которые меняют поведение модели.

Хотите внедрить, но некогда разбираться?

Подберу скиллы под вашу задачу, поставлю и покажу на живом примере — быстрее, чем читать документацию.

Получить консультацию
Дальше

Куда идти дальше

Словарь терминов

Промпт, токен, MCP, агент — 44 понятия простыми словами, если что-то на этой странице звучит незнакомо.

Открыть словарь

Гайды

Пошаговые разборы: от первого промпта до своих агентов и автоматизации.

К каталогу гайдов
Вопросы

Частые вопросы

Что делает скилл LLM Evaluation?
Оценка качества ИИ-приложений: метрики, галлюцинации, регрессии. Это Agent Skill — текстовое расширение для Claude Code и Cursor: подключается файлом SKILL.md и меняет поведение ассистента, кода внутри нет. Темы скилла: llm, evaluation, ragas, ai, benchmarks.
Как установить LLM Evaluation?
Склонируйте репозиторий автора в папку скиллов: git clone https://github.com/rmyndharis/antigravity-skills ~/.claude/skills/llm-evaluation — и перезапустите Claude Code, он подхватит скилл сам. В Cursor и похожих редакторах скопируйте содержимое SKILL.md в правила проекта. Перед установкой файл стоит прочитать: это обычный текст.
Это бесплатно?
Да. Скилл «LLM Evaluation» открыт: автор — rmyndharis, скачивается из официального репозитория без регистрации. Распространяется под лицензией MIT. На этой странице ничего покупать не нужно — каталог часть моего раздела «Обучение».

Нужен такой результат в вашей работе?

Напишите, чем занимаетесь, — скажу, закроет ли задачу этот скилл или собрать решение под вас.

Получить консультацию

Пн–Вс, 10:00–20:00. Отвечаю лично.