AITeX★ 2,472
TsinghuaC3I/Awesome-RL-for-LRMs
ОБЗОР RL ДЛЯ БОЛЬШИХ МОДЕЛЕЙ
Обзор современных методов обучения с подкреплением для больших моделей рассуждений, включая теории и практические подходы.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Систематизация более 150 статей по RL для LRMs
- Таксономия подходов: от reward shaping до inverse RL
- Практические рекомендации и открытые benchmarks
#awesome-list#deepseek-r1#llm#lrm#open-source#reasoning#rl
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram