Генерация фото по тексту
#paper #tech
OpenAI представляет DALL·Е: нейронную сеть, которая генерирует изображения по текстовому описанию.
Да-да, именно так. Не наоборот) Люди давно научились генерировать описания картинок, а вот обратная задача казалась слишком сложной. Генерировать фото по тексту правда сложнее: нужно уметь рисовать разнообразные формы и их сочетания, уметь показывать пространственные и смысловые отношения между объектами. Поэтому долгое время ИИ не мог решить эту задачу.
То, что показали нам OpenAI — это шедевр! Модель DALL·Е генерирует точные картинки по самым сложным описаниям. Модель умеет понимать пространственные, смысловые, временные зависимости, зависимости стиля и даже соединять несочетаемое! Нарисовать "американский пейзаж", "телефон 20х годов" или даже "смесь жирафа с черепахой" для модели не проблема.
На картинке выше — картинка к тексту "малыш дайкон в балетной пачке выгуливает собачку". Это офигенно! 😱
Больше примеров генерации фото по тексту смотрите в блоге OpenAI.
Поиграться с моделью самому пока еще нельзя. Но мы очень ждем, руки прям чешутся 🌝. А вы?)
Post #41
1.63K