>ИИ-офисМаркетплейс скилов
Все скилыНаборыПрофессииКатегорииFAQ
@openai_ruВойти
Все скилыНаборыПрофессииКатегорииFAQ
telegram

Сборник материалов про вайбкодинг и нейросети — где брать скилы, как собирать и применять их на практике.

  • бесплатно
  • то, чем сам пользуюсь
  • новые скилы и разборы каждую неделю
Подписаться в Telegram

Категории скилов

  • Разработка
  • Инструменты
  • Бизнес
  • Контент и медиа
  • Данные и ИИ
  • Тестирование и безопасность
  • DevOps
  • Документация

Скилы по профессии

  • Разработка и программирование
  • Операционка и автоматизация
  • Маркетинг и контент
  • Продакт-менеджмент
  • Дата-сайенс и ML
  • Дизайн и UX/UI
  • Тестирование и QA
  • Креатив (видео, фото, презентации)

Маркетплейс

  • Все скилы
  • Все скилы списком
  • Наборы
  • Гайды по AI
  • Понятия: словарь ИИ
  • Профессии
  • Категории
  • Направления
  • FAQ

Telegram

  • Канал про вайбкодинг и нейросети
  • Войти в портал

Контакт и правовое

  • Написать в Telegram
  • Политика конфиденциальности
© ИИ-офис 2026
// Маркетплейс скилов для Claude Code@openai_ru
Маркетплейс скилов/Разработка и программирование/LLM Evaluation
llm-evaluation.mdПубличный

LLM Evaluation

Оценка качества LLM-приложений и агентов

ВайбкодингРазработка и программированиеДата-сайенс и MLТестирование и QAДанные и ИИТестирование и безопасность
llmevaluationragasaibenchmarkshallucination

О скиле

Учит Claude оценивать качество LLM-приложений — как проверить что ваш AI-агент или чат-бот отвечает правильно и стабильно. Скил охватывает бенчмарки для LLM, метрики RAGAS (для оценки RAG-систем), обнаружение галлюцинаций (когда AI выдумывает факты), скоринг качества ответов и построение evaluation pipeline. Также A/B тестирование промптов. Если вы строите AI-продукт — получите объективные метрики вместо ощущений кажется работает. Если ML-инженер — внедрите автоматическую проверку регрессий в AI-поведении. Работает с Claude Code.

Об источнике

Автор скила — rmyndharis. Репозиторий проекта собрал 881 звёзд на GitHub. Распространяется под лицензией MIT. Открыть репозиторий.

Как установить

  1. Открой папку скилов Claude Code: open ~/.claude/skills/

  2. Склонируй репозиторий: git clone https://github.com/rmyndharis/antigravity-skills ~/.claude/skills/llm-evaluation

  3. Перезагрузи Claude Code — скил подхватится автоматически.

  4. Активируй в чате: Use llm-evaluation skill.

Установка

Открыть репозиторийgithub.com/rmyndharis/antigravity-skills

Не уверены, куда положить .md-файл? как установить скилл в Claude Code — пошаговый гайд.

telegram

Разбираю скилы вроде этого и близкие по теме «Данные и ИИ»: где брать, как собирать и применять их на практике.

  • бесплатно
  • то, чем сам пользуюсь
  • новые скилы и разборы каждую неделю
Подписаться в Telegram

Похожие скилы

// продолжай по той же профессии или категории
  • LLM Prompt Injection
    Защита от инъекций в LLM-приложениях
  • Agent Eval
    Сравнение AI-агентов по реальным задачам
  • Eval Harness
    Фреймворк оценки качества Claude-сессий
  • Playwright E2e Tests
    E2E-тесты для AI-приложений на Playwright
  • Data Quality Frameworks
    Тесты и контроль качества данных
  • Prompt Optimization
    Оптимизация промптов для LLM-приложений

Связанные гайды

// как применять скилы Claude Code на практике
  • Скиллы для аналитики данных и Excel в Claude
    Скилы Claude для аналитики: работа с Excel и xlsx, SQL-запросы, финансовый анализ и дашборды. Что поставить под данные и ссылки на карточки маркетплейса.
  • Скиллы Claude для кибербезопасности
    Скилы Claude для кибербезопасности: 754 скила от Anthropic по MITRE ATT&CK и OWASP, сканирование уязвимостей, моделирование угроз, пентест, безопасность API. Что ставить.
  • Лучшие скиллы для Claude Code: топ-каталог 2026
    Топ навыков для Claude Code 2026 по категориям: дизайн, планирование, документы, данные, текст. Что поставить, сводная таблица и ссылки на карточки маркетплейса.
  • Как установить skill в Claude Code: пошагово 2026
    Как установить скилл в Claude Code и Claude.ai: папка с SKILL.md в ~/.claude/skills/, загрузка .zip и установка из GitHub или маркетплейса. Три способа по шагам.
Вся тема «Claude Code: гайды от установки до продвинутой работы»: 72 гайдов
Непонятные термины? Загляни в «Понятия» — словарь ИИ

Частые вопросы

Что такое скил «LLM Evaluation»?
▶
«LLM Evaluation» — готовый Agent Skill для Claude Code и Cursor. Это .md-файл с системным промптом, который подключается одним файлом и расширяет возможности AI-редактора в задачах Вайбкодинг. Категория инструмента: Данные и ИИ, Тестирование и безопасность. Чаще всего пригождается профессиям: Разработка и программирование, Дата-сайенс и ML, Тестирование и QA. Ключевые темы скила: llm, evaluation, ragas, ai, benchmarks, hallucination.
Как установить скил «LLM Evaluation» в Claude Code?
▶
Скачайте .md-файл скила «LLM Evaluation» на этой странице и положите его в папку ~/.claude/skills/ вашего проекта. Перезапустите Claude Code — скил подхватится автоматически. Для Cursor и Windsurf скопируйте содержимое .md-файла в системный промпт проекта (Settings → Rules). Исходный код скила открыт в репозитории github.com/rmyndharis/antigravity-skills.
Бесплатен ли скил «LLM Evaluation»?
▶
Да, скил «LLM Evaluation» доступен бесплатно для всех пользователей без регистрации — скачайте .md-файл прямо на этой странице. Автор скила — rmyndharis, распространяется под лицензией MIT.

Больше вопросов про Agent Skills — общий FAQ маркетплейса

// metadata
881на GitHub
Форки
164
Обновлён
3 мес. назад
Автор
rmyndharis