Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers
Убийца... ВСЕГО.
Ладно, это преувеличение. Всего лишь мультимодальный преобразователь текста в картинки, видео, речь, 3D модели.
Умеет (см видео)
- создавать заданную композицию
- консистентно генерировать в заданном стиле
- креативный апскейл
- редактировать изображения
Код
Веса
Демо (генератор картинок)
#upscale #text2image #text2video #text2speech #textto3D #imageediting #image2image #multimodal
Post #4194
2.04K