Agent Eval
Сравнение AI-агентов по реальным задачам
О скиле
Запускает честное сравнение ИИ-агентов — Claude Code, Aider, Codex и других — на ваших реальных задачах и кастомных бенчмарках. Не синтетические тесты из интернета, а задачи из вашего проекта: написать функцию, исправить баг, объяснить архитектуру. Если вы разработчик, выбирающий инструмент, получаете данные именно для своего стека, а не общую статистику. Если вы исследователь AI, строите воспроизводимые эксперименты. Подключается к Claude Code из ECC.
Об источнике
Автор скила — affaan-m. Репозиторий проекта собрал 218k звёзд на GitHub. Распространяется под лицензией MIT. Открыть репозиторий.
Как установить
Установка
Разбираю скилы вроде этого и близкие по теме «Данные и ИИ»: где брать, как собирать и применять их на практике.
Похожие скилы
// продолжай по той же профессии или категорииСвязанные гайды
// как применять скилы Claude Code на практикеЧастые вопросы
- Что такое скил «Agent Eval»?
- Как установить скил «Agent Eval» в Claude Code?
- Бесплатен ли скил «Agent Eval»?
Больше вопросов про Agent Skills — общий FAQ маркетплейса