AIPython★ 191
vllm-project/vime
Фреймворк постобучения LLM
VIME — это фреймворк для пост‑обучения больших языковых моделей с использованием vLLM, ориентированный на масштабирование обучения с подкреплением.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Масштабируемое обучение RLHF и PPO через vLLM inference engine.
- Поддержка множества алгоритмов RL: PPO, DPO, REINFORCE и пользовательские стратегии.
- Эффективное многокарточное обучение с тензорным параллелизмом и шардингом моделей.
- Интеграция с HuggingFace Transformers и datasets.
Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram