llm-evaluation.mdПубличный

Llm Evaluation

Оценка качества LLM-приложений и агентов

О скиле

Учит Claude оценивать качество LLM-приложений — как проверить что ваш AI-агент или чат-бот отвечает правильно и стабильно. Скил охватывает бенчмарки для LLM, метрики RAGAS (для оценки RAG-систем), обнаружение галлюцинаций (когда AI выдумывает факты), скоринг качества ответов и построение evaluation pipeline. Также A/B тестирование промптов. Если вы строите AI-продукт — получите объективные метрики вместо ощущений кажется работает. Если ML-инженер — внедрите автоматическую проверку регрессий в AI-поведении. Работает с Claude Code.

Об источнике

Автор скила — rmyndharis. Репозиторий проекта собрал 881 звёзд на GitHub. Распространяется под лицензией MIT. Открыть репозиторий.

Как установить

  1. Открой папку скилов Claude Code: open ~/.claude/skills/

  2. Склонируй репозиторий: git clone https://github.com/rmyndharis/antigravity-skills ~/.claude/skills/llm-evaluation

  3. Перезагрузи Claude Code — скил подхватится автоматически.

  4. Активируй в чате: Use llm-evaluation skill.

Установка

Не уверены, куда положить .md-файл? как установить скилл в Claude Code — пошаговый гайд.

telegram

Разбираю скилы вроде этого и близкие по теме «Данные и ИИ»: где брать, как собирать и применять их на практике.

  • бесплатно
  • то, чем сам пользуюсь
  • новые скилы и разборы каждую неделю
Подписаться в Telegram
// продолжай по той же профессии или категории
// как применять скилы Claude Code на практике
Непонятные термины? Загляни в «Понятия» — словарь ИИ

Частые вопросы

Что такое скил «Llm Evaluation»?
«Llm Evaluation» — готовый Agent Skill для Claude Code и Cursor. Это .md-файл с системным промптом, который подключается одним файлом и расширяет возможности AI-редактора в задачах Вайбкодинг. Категория инструмента: Данные и ИИ, Тестирование и безопасность. Чаще всего пригождается профессиям: Разработка и программирование, Дата-сайенс и ML, Тестирование и QA. Ключевые темы скила: llm, evaluation, ragas, ai, benchmarks, hallucination.
Как установить скил «Llm Evaluation» в Claude Code?
Скачайте .md-файл скила «Llm Evaluation» на этой странице и положите его в папку ~/.claude/skills/ вашего проекта. Перезапустите Claude Code — скил подхватится автоматически. Для Cursor и Windsurf скопируйте содержимое .md-файла в системный промпт проекта (Settings → Rules). Исходный код скила открыт в репозитории github.com/rmyndharis/antigravity-skills.
Бесплатен ли скил «Llm Evaluation»?
Да, скил «Llm Evaluation» доступен бесплатно для всех пользователей без регистрации — скачайте .md-файл прямо на этой странице. Автор скила — rmyndharis, распространяется под лицензией MIT.

Больше вопросов про Agent Skills — общий FAQ маркетплейса