AIPython★ 514
relari-ai/continuous-eval
CONTINUOUS-EVAL - ОЦЕНКА LLM НА ДАННЫХ
Платформа для автоматической оценки LLM‑приложений на основе реальных данных. Позволяет измерять качество и улучшать модели без ручного труда.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Автоматический сбор метрик из логов и тестов
- Поддержка популярных фреймворков: LangChain, LlamaIndex, Haystack
- Визуализация трендов качества в реальном времени
#evaluation-framework#evaluation-metrics#information-retrieval#llm-evaluation#llmops#rag#retrieval-augmented-generation
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram