🎨 На рынке генераторов картинок появился сильный игрок, способный потеснить признанных лидеров. Исследовательская лаборатория Reve AI из Пало-Альто, в которой работают всего
65 человек, представила флагманскую модель
Reve 2.0. Команда совершила технологический маневр, который позволил маленькому стартапу на равных конкурировать с триллионными IT-гигантами.
⚡️ Главное отличие новинки — уникальный двухшаговый метод генерации «изображения как код» (Large Layout Model). Большинство нейросетей переводят ваш текст в пиксели напрямую, из-за чего часто путают детали. Как
пишет VC.ru, Reve 2.0 работает иначе:
① Сначала умный алгоритм создает невидимый текстовый чертеж — подробный структурированный код сцены. Он строго размечает, где именно будут находиться объекты, каковы их пропорции, где должен быть текст и как элементы связаны между собой.
② Только после этого диффузионная модель
рендерит (отрисовывает финальный цифровой рисунок) готовую картинку на основе этого чертежа.
🎯 【В чем польза】 Такой подход решает главную боль дизайнеров — сложность точечного редактирования. Теперь можно легко изменить или подвинуть один конкретный объект на картинке, не ломая и не перерисовывая всю композицию целиком. Кроме того, Reve 2.0 сразу выдает изображения в
честном разрешении 4K без использования апскейлеров
(программ для искусственного растягивания размера картинок).
Модель отлично справляется со сложными задачами: она без ошибок пишет длинные тексты на изображениях, аккуратно рисует интерфейсы приложений, рекламные макеты и создает качественные фотореалистичные сцены.
🆕 По результатам тестов новинка мгновенно взлетела на верхние строчки авторитетных рейтингов, о чем активно
спорят на Reddit. Оценить возможности новой технологии и протестировать генератор Reve 2.0 можно бесплатно
на официальном сайте проекта.
🔸Токен за токеном...