R_REDDYX.XYZ
AIJava276

beehive-lab/jllm

JLLM: GPU‑УСКОРЕННЫЙ LLAMA3.JAVA

Проект jllm реализует инференс Llama3.java на GPU с помощью TornadoVM, оставаясь полностью на Java. Поддерживает форматы GGUF и работу с моделями DeepSeek‑R1 и Granite. Есть 276 звёзд на GitHub.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Выполняет инференс Llama3 моделей на GPU через TornadoVM без native кода.
  • Поддерживает загрузку и выполнение моделей в формате GGUF напрямую из Java.
  • Обеспечивает ускорение до нескольких раз по сравнению с чистым CPU‑Java инференсом.
  • Совместим с моделями DeepSeek‑R1, Granite и другими LLAMA‑подобными checkpoint‑ами.
#accelerators#compilers#deepseek-r1#gguf#gpu#granite#ibm-granite#java#java21#llama3#llm#mistral
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

beehive-lab/jllm — JLLM: GPU‑УСКОРЕННЫЙ LLAMA3.JAVA |…