R_REDDYX.XYZ
AIPython1,734

vllm-project/vllm-metal

VLLM-METAL: УСКОРЯЕМ LLM НА APPLE SILICON

vllm-metal — это сообщество‑поддерживаемый плагин аппаратного ускорения для vLLM на процессорах Apple Silicon. Использует фреймворк Metal и MLX для эффективного выполнения больших языковых моделей на Mac. Позволяет запускать LLM с низкой задержкой и высокой пропускной способностью без CUDA.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Поддерживает аппаратное ускорение через Metal на Apple Silicon (M1/M2/M3).
  • Интегрируется с vLLM как плагин, заменяя бэкенд CUDA на MLX.
  • Обеспечивает низкую латентность инференса LLM на macOS без внешних драйверов.
  • Поддерживает квантование и динамическую batch‑обработку для повышения throughput.
#apple-silicon#llm#macos#metal#mlx#vllm
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

vllm-project/vllm-metal — VLLM-METAL: УСКОРЯЕМ LLM НА…