AIPython★ 273
kyegomez/NaViT
NAVIT — VISION TRANSFORMER ДЛЯ ЛЮБОГО ФОРМАТА
Реализация статьи Patch n’ Pack: NaViT – Vision Transformer, работающий с любым соотношением сторон и разрешением без падддинга.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- Поддерживает произвольное соотношение сторон изображений
- Убирает необходимость в паддинге и масштабировании
- Реализован на PyTorch, прост в интеграции
#attention-mechanism#clip#gpt4#multimodal#multimodal-deep-learning#multimodal-learning#multimodality#vit
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram