R_REDDYX.XYZ
AIShell276

peonist-ai/halogen-flash-server

БЫСТРЫЙ ЗАПУСК QWEN3.8 НА AMD

Проект предоставляет скрипты для мгновенного развёртывания Qwen3.8-Flash-Next на GPU AMD Strix Halo (gfx1151) через HIP. Все зависимости собираются автоматически, а inference работает с максимальной пропускной способностью.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Запускает Qwen3.8-Flash-Next на AMD Strix Halo (gfx1151) за секунды через HIP.
  • Собирает зависимости LLVM, ROCm, HIP, PyTorch скриптом install.sh без ручной настройки.
  • Оптимизирует ядра инференса под gfx1151, достигая peak TFLOPs и минимальной латентой.
  • Поддерживает FP16/BF16 и динамический батчинг для max throughput.
#amd#gfx1151#gpu-inference#hip#inference-engine#llm#llm-serving#local-llm#long-context#mixture-of-experts#openai-api#qwen
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

peonist-ai/halogen-flash-server — БЫСТРЫЙ ЗАПУСК QWEN3.8…