AIPython★ 204
whitecircle/halo
HALO: ФРЕЙМВОРК ОБУЧЕНИЯ LLM
Halo — открытый фреймворк от White Circle для обучения больших языковых и мультимодальных моделей. Поддерживает агентное обучение, async-RL, распределённое обучение и fine-tuning через GRPO. Написан на Python, собрал 204 звёзды в GitHub.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Обучает LLM и мультимодальные модели с использованием алгоритма GRPO.
- Поддерживает агентное обучение с интеграцией окружений и политик.
- Обеспечивает async-RL параллельное обучение агентов в распределённом кластере.
- Позволяет выполнять fine-tuning больших моделей на нескольких GPU с автошардировкой.
#agent#async-rl#distributed-training#fine-tuning#grpo#large-language-models#llm#lora#model-parallelism#moe#multimodal#peft
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram