LIVE СВЕЖЕЕ
Securityskill-scanner: Анализ безопасности Skill, локальноSecurityskill-safe-install-l0-strict: Безопасная установка скилловTechnical Docsskill-creator: Создание и оптимизация скилловSecuritySecurity Skill: анализ и защита данныхTestingquality-gate: Скилл итеративного улучшения артефактовAutomation To..redis-development: Скилл оптимизации производительности RedisTechnical Docsjsdoc-comment-generator: Скилл для автоматической генерации комментариевNoSQL Databasesbackend-coding-standards: Скилл для стандартизации кодаAutomation To..openapi-spec-generator: Скилл для генерации APIDatabase Toolstype-mapping-encyclopedia: Скилл для преобразования типов данныхSecurityskill-scanner: Анализ безопасности Skill, локальноSecurityskill-safe-install-l0-strict: Безопасная установка скилловTechnical Docsskill-creator: Создание и оптимизация скилловSecuritySecurity Skill: анализ и защита данныхTestingquality-gate: Скилл итеративного улучшения артефактовAutomation To..redis-development: Скилл оптимизации производительности RedisTechnical Docsjsdoc-comment-generator: Скилл для автоматической генерации комментариевNoSQL Databasesbackend-coding-standards: Скилл для стандартизации кодаAutomation To..openapi-spec-generator: Скилл для генерации APIDatabase Toolstype-mapping-encyclopedia: Скилл для преобразования типов данных
$ pwd: ~ / categories / Testing & Security / Testing / agentic-eval-iterativnaya-otsenka-i-uluchshenie-ai-agentov
view --main agentic-eval-iterativnaya-otsenka-i-uluchshenie-ai-agentov.md

agentic-eval — Итеративная оценка и улучшение AI-агентов

//

Разрабатывайте более точные и качественные решения с помощью AI-агентов, способных к самооценке и улучшению. agentic-eval предоставляет проверенные шаблоны и инструменты для создания итеративных циклов оценки и доработки результатов, позволяя большим языковым моделям (LLM) повышать точность и соответствие заданным критериям.

Репозиторий предлагает практические решения для реализации самокритики и доработки, основанные на четко определенных критериях оценки. Используя Python и LLM APIs, вы сможете интегрировать циклы самооценки в ваши AI-агенты, что особенно важно для задач, требующих высокой точности, таких как генерация кода или составление отчетов. Поддерживается работа с форматами JSON и интеграция с GitHub Copilot.

agentic-eval идеально подходит для сценариев, где важна оценка качества, существуют четкие метрики успеха и требуется соблюдение определенных стандартов. Шаблоны включают определение критериев оценки, создание циклов самокритики и доработку на основе обратной связи, обеспечивая постоянное улучшение производительности искусственного интеллекта.

Проводник файлов
1 файлы
SKILL.md
SKILL.md
readonly --- lines
Инициализация мануала...
package.json
Author
author
⭐ 27.5k | 🍴 3,179
github
// Verified Repository Master Account
$ gh browse
$ install --global skills.sh
npx skills add https://github.com/github/awesome-copilot/tree/main/skills/agentic-eval
$ download --local man

[HINT] Скачивает всю директорию скилла с GitHub: SKILL.md и все связанные файлы