R_REDDYX.XYZ
AIPython97

leyten/shard

Shard: распределённый вывод

Shard реализует pipeline‑параллелизм для запуска больших языковых моделей на нескольких GPU‑узлах, позволяя выполнять inference без необходимости размещать всю модель в памяти одного устройства.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Pipeline‑параллелизм слоёв модели между GPU на разных машинах.
  • Автоматическое разделение и сборка тензоров, минимизирующее задержки передачи данных.
  • Поддержка Hugging Face Transformers и динамический batching роста пропускной способности.
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

leyten/shard — Shard: распределённый вывод | REDDYX AI