AIPython★ 882
OpenMOSS/AnyGPT
ANYGPT — ЕДИНЫЙ МУЛЬТИМОДАЛЬНЫЙ ЯЗЫКОВОЙ МОДЕЛЬ
AnyGPT — это универсальная мультимодальная модель, построенная на дискретном последовательном моделировании. Она генерирует изображения, музыку и речь из текста и понимает перевод между модальностями.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Генерирует фотореалистичные изображения из текста за секунды.
- Синтезирует естественную речь и музыку по текстовым подсказкам.
- Выполняет любой‑в‑любой перевод: текст ↔ изображение ↔ аудио.
- Поддерживает fine‑tuning на пользовательских мультимодальных датасетах через простой CLI.
#any-to-any#image-generation#large-language-models#multimodal#music-generation#speech
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram