👋 Хакатоны хакатонами, но интересные статьи по расписанию!
Исследователи из Yandex Research разработали новый подход генерации изображений и назвали Switty (Scale-wise transformer for text-to-image synthesis). Он не уступает диффузионным моделям по качеству, но при этом намного быстрее. Switti генерирует изображения всего за 0,1 секунды - буквально космическая скорость!🚀🚀🚀
Для сравнения: это в 7 раз быстрее, чем у оригинального SDXL и в 2 раза быстрее, чем у ускоренных версий, таких как SDXL-Turbo и SDXL-DMD2! (Надеюсь, вы следите за разработками в сфере генеративных нейросетей и знаете, что такое SDXL-Turbo и SDXL-DMD2😅).
Хоть модель и создана на базе авторегрессионных моделей, Switti уже превосходит как предыдущие AR, так и зарубежные диффузионные модели в скорости.
🎚️ Изучаем
Демка на huggingface
Статья на arxiv
А вот тут код
Post #1117
4.8K

- 🔥 20
- 👍 11
- ❤ 2