AIShell★ 276
peonist-ai/halogen-flash-server
БЫСТРЫЙ ЗАПУСК QWEN3.8 НА AMD
Проект предоставляет скрипты для мгновенного развёртывания Qwen3.8-Flash-Next на GPU AMD Strix Halo (gfx1151) через HIP. Все зависимости собираются автоматически, а inference работает с максимальной пропускной способностью.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Запускает Qwen3.8-Flash-Next на AMD Strix Halo (gfx1151) за секунды через HIP.
- Собирает зависимости LLVM, ROCm, HIP, PyTorch скриптом install.sh без ручной настройки.
- Оптимизирует ядра инференса под gfx1151, достигая peak TFLOPs и минимальной латентой.
- Поддерживает FP16/BF16 и динамический батчинг для max throughput.
#amd#gfx1151#gpu-inference#hip#inference-engine#llm#llm-serving#local-llm#long-context#mixture-of-experts#openai-api#qwen
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram