AI★ 1,611
MLGroupJLU/LLM-eval-survey
ОБЗОР ОЦЕНКИ БОЛЬШИХ ЯЗЫКОВЫХ МОДЕЛЕЙ
Официальная страница репозитория для обзорной статьи по оценке больших языковых моделей.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Систематический обзор метрик оценки LLM
- Сравнение подходов: от простых до сложных
- Рекомендации для исследователей и практиков
#benchmark#evaluation#large-language-models#llm#llms#model-assessment
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram