Qwen-Image-2.1: одна модель для генерации, монтажа изображений и прозрачных слоёв.
И это открытая модель. То есть ее можно ставить локально и работать.
Qwen - семейство AI-моделей команды Alibaba. Его новая модель Qwen-Image-2.1 создаёт картинки по тексту и редактирует готовые изображения.
Это не видеогенератор: речь о кадрах, иллюстрациях и графических элементах.
Что нового? Модель умеет сразу создавать изображение с прозрачным фоном, редактировать такой слой и вырезать нужный объект из обычной фотографии в прозрачный RGBA-элемент.
Для дизайна и композитинга это удобнее, чем сначала генерировать картинку, а затем отдельно удалять фон.
Можно подать до 10 референсов.
Например, собрать персонажей из отдельных портретов в один кадр или совместить модель, одежду и аксессуары.
Локальную правку можно указать маской, нарисованной пометкой или цветным кругом на исходнике.
Заявлена генерация примерно в 2K и улучшенная передача текста и деталей.
Для AI-кино здесь особенно интересны две вещи: сборка сцены по нескольким утверждённым референсам и подготовка прозрачных элементов для дальнейшего монтажа.
Рабочие веса уже опубликованы, есть инструкции для ComfyUI и Diffusers.
Но это возможности по материалам разработчика, а не наша независимая проверка качества или стабильности персонажей.
Важное ограничение: веса выпущены по Qwen Research License.
Она разрешает некоммерческое исследование и оценку; для коммерческого использования нужна отдельная лицензия.
Не стоит автоматически включать эту модель в оплачиваемый продакшен, не разобравшись с правами.
Официальные источники:
https://qwen.ai/blog?id=qwen-image-2.1
https://github.com/QwenLM/Qwen-Image-2.1
https://huggingface.co/Qwen/Qwen-Image-2.1
https://github.com/QwenLM/Qwen-Image-2.1/blob/main/LICENSE
Post #4718
6.39K

- 🔥 28
- ❤ 5
- 🎉 2