TGViewer
эйай ньюз эйай ньюз @ai_newz · 97.2K subscribers
Post #4079 28K
Qwen Image

Новый открытый генератор картинок от китайцев из Alibaba — они не перестают закидывать нас релизами. Помимо просто генерации картинок, модель очень хорошо умеет в текст и редактирование изображений, на уровне или лучше GPT 4o и FLUX Kontext.

Технически это MMDiT (как Stable Diffusion 3 или FLUX.1) на 20B параметров, что прямо много для консьюмерских карточек, но посмотрим что смогут сделать умельцы. Для редактирования используют чуть более продвинутую версию подхода из FLUX Kontext — модели так же дают увидеть изначальное изображение в процессе редактирования, но ввели свою схему для positional encoding.

Эта модель явно в канве работ над омни моделями, надеюсь Qwen 4/Qwen 5 будут полноценным мультимодальным претрейном. Кроме весов выложили и детальный техрепорт о тренировке модели, который я разберу где-то на днях.

Веса
Блогпост
Техрепорт

@ai_newz
  • 🔥 139
  • 👍 31
  • ❤ 27
  • 🤩 3
  • ⚡ 1
More from @ai_newz
  1. Oct 6, 2026Mistral выпустили Le Chaton Fat Le Chonk Mistral Large 4 это модель на триллион параметров…
  2. Oct 6, 2026OpenAI начала вводить вотермарки для текста Пока что это опция для API, которую можно добр…
  3. Oct 5, 2026Google урежут бесплатный Gemini до Flash-Lite С 9 октября в приложении Gemini начнут убира…
  4. Oct 5, 2026Почему роботов учат в симуляторах Собирать данные на реальных роботах дорого и долго. Симу…
  5. Oct 5, 2026Нейродайджест за неделю (#133) LLM - DevDay OpenAI — OpenAI представила постоянно работающ…
  6. Oct 4, 2026Google отправили четыре TPU в космос Прототип Project Suncatcher вышел на орбиту 1 октября…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →