Google представила Nano Banana 2.1. Это новая модель для генерации и редактирования изображений.
По заявлению компании, она сохраняет скорость семейства Flash, но лучше следует запросу, реалистичнее рисует изображения и увереннее сохраняет персонажей при последовательных правках.
Самое интересное для работы с готовыми кадрами - редактирование по маске. Google прямо называет его среди новых возможностей.
Но пока не объясняет подробно, как именно задаётся маска и насколько надёжно модель сохраняет область за её пределами.
Обещание точечной правки ещё предстоит проверить на практике.
Что подтверждено документацией:
• Вывод в 1K, 2K и 4K. Режима 0,5K у версии 2.1 нет. Для обложки 16:9 это соответственно 1376×768, 2752×1536 и 5504×3072 пикселя.
• 14 форматов кадра, включая 1:1, 4:5, 9:16, 16:9, 21:9 и экстремально широкие 4:1 и 8:1. Google отдельно сообщает, что исправила артефакты «плитки» на панорамных изображениях в 2K и 4K.
• До 14 изображений-референсов в одной задаче: заявлена консистентность до четырёх персонажей и точность воспроизведения до десяти объектов
• Улучшены надписи и компоновка инфографики. Это важно для постеров, меню, схем и обложек, где текст - часть изображения.
• Модель умеет опираться на веб-поиск и поиск изображений Google. Доступны три уровня «размышления»: minimal, medium (по умолчанию) и high.
• На вход можно подавать текст, изображения, видео и PDF; на выходе - изображение и текст. Есть диалоговое редактирование, когда результат уточняется следующими запросами.
Nano Banana 2.1 уже предлагается в Google AI Studio и через Gemini API под именем gemini-nano-banana-2.1. В каталоге API модель обозначена как стабильная.
На создаваемые изображения Google наносит невидимую маркировку SynthID.
Post #4762
4.22K

- 🔥 40
- ❤ 15
- 👌 2