Автор и репозиторий
Автор — affaan-m. Репозиторий собрал 220k звёзд на GitHub. Распространяется под лицензией MIT. Файл eval-harness.md открыт: прочитать его можно до установки.
Открыть репозиторийИзмеряет качество работы агента вместо «вроде стало лучше».
Формальная система оценки сессий Claude Code: измеряет качество ответов агента, риск ухудшений после правок и точность выбора модели под конкретные задачи. Отвечает на вопросы, которые обычно решаются на глаз: этот промпт стал лучше или хуже, какая модель справляется точнее. Тому, кто серьёзно работает с ИИ-агентами, даёт переход от ощущений к измерениям.
Автор — affaan-m. Репозиторий собрал 220k звёзд на GitHub. Распространяется под лицензией MIT. Файл eval-harness.md открыт: прочитать его можно до установки.
Открыть репозиторийСклонируйте репозиторий в ~/.claude/skills/ и перезапустите Claude Code — скилл подхватится сам. Дальше просто попросите ассистента использовать «Eval Harness».
Скопируйте содержимое SKILL.md в системные правила проекта. Скиллы не запускают код — это текстовые инструкции, которые меняют поведение модели.
Подберу скиллы под вашу задачу, поставлю и покажу на живом примере — быстрее, чем читать документацию.
Получить консультациюАнализ данных, пайплайны, ML, интеграция LLM в продукты.
Ко всем скиллам категорииПромпт, токен, MCP, агент — 44 понятия простыми словами, если что-то на этой странице звучит незнакомо.
Открыть словарьПошаговые разборы: от первого промпта до своих агентов и автоматизации.
К каталогу гайдовНапишите, чем занимаетесь, — скажу, закроет ли задачу этот скилл или собрать решение под вас.
Получить консультациюПн–Вс, 10:00–20:00. Отвечаю лично.