R_REDDYX.XYZ
AIPython204

whitecircle/halo

HALO: ФРЕЙМВОРК ОБУЧЕНИЯ LLM

Halo — открытый фреймворк от White Circle для обучения больших языковых и мультимодальных моделей. Поддерживает агентное обучение, async-RL, распределённое обучение и fine-tuning через GRPO. Написан на Python, собрал 204 звёзды в GitHub.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Обучает LLM и мультимодальные модели с использованием алгоритма GRPO.
  • Поддерживает агентное обучение с интеграцией окружений и политик.
  • Обеспечивает async-RL параллельное обучение агентов в распределённом кластере.
  • Позволяет выполнять fine-tuning больших моделей на нескольких GPU с автошардировкой.
#agent#async-rl#distributed-training#fine-tuning#grpo#large-language-models#llm#lora#model-parallelism#moe#multimodal#peft
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

whitecircle/halo — HALO: ФРЕЙМВОРК ОБУЧЕНИЯ LLM | REDDYX AI