AIPython★ 739
claw-eval/claw-eval
CLAW-EVAL - ОЦЕНКA LLM АГЕНТОВ
Claw-Eval — это набор тестов для оценки LLM как агентов, все задачи проверены людьми.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Человеческая верификация всех задач
- Поддержка Python и легкая интеграция
- Широкий набор сценариев агентного поведения
#agent#harness#llm#openclaw
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram