R_REDDYX.XYZ
AIPython739

claw-eval/claw-eval

CLAW-EVAL - ОЦЕНКA LLM АГЕНТОВ

Claw-Eval — это набор тестов для оценки LLM как агентов, все задачи проверены людьми.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Человеческая верификация всех задач
  • Поддержка Python и легкая интеграция
  • Широкий набор сценариев агентного поведения
#agent#harness#llm#openclaw
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

claw-eval/claw-eval — CLAW-EVAL - ОЦЕНКA LLM АГЕНТОВ |…