AIPython★ 842
mbzuai-oryx/LLaVA-pp
LLaVA++: НОВЫЙ УРОВЕНЬ МУЛЬТИМОДАЛЬНОСТИ
LLaVA++ добавляет поддержку моделей Phi‑3 и LLaMA‑3 к оригинальному LLaVA, обеспечивая мультимодальный чат и генерацию изображений. Пользователи получают улучшенное понимание текста и визуала благодаря интеграции передовых LLM.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Поддерживает мультимодальный чат: текст + изображение с моделями Phi‑3 и LLaMA‑3.
- Генерирует ответы, учитывая как текстовый, так и визуальный контекст одновременно.
- Дообучает LLaVA‑pp на пользовательских парах изображение‑текст.
- Предлагает готовый REST API и Python SDK для интеграции в любые приложения.
#conversation#llama-3-llava#llama-3-vision#llama3#llama3-llava#llama3-vision#llava#llava-llama3#llava-phi3#llm#lmms#phi-3-llava
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram