TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2829 1.78K
Ant Group выложила LLaDA-Image, открытую модель с диффузионным трансформером на 6 млрд параметров, которая и генерирует картинки, и редактирует их по инструкции одним чекпоинтом. Устройство необычное: и языковой бэкбон, и картиночная часть здесь диффузионные, обучены в одной рамке. Есть базовая версия на 50 шагов и Turbo на 4 шага, обе рисуют текст на английском и китайском.

На Qwen-Image-Bench модель первая среди открытых, впереди Z-Image Turbo и HunyuanImage 3.0, но до закрытых не дотягивает: FLUX.2 Max, Seedream 5.0, Qwen-Image 2.0 Pro и Nano Banana 2.0 выше, GPT-Image 2 впереди почти на 12 баллов, график на картинке.

Веса лежат на HuggingFace под Apache 2.0, есть FP8-варианты и демо Turbo. Код обучения обещают позже.

@neuro_channel
  • ❤ 3
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токен…
  5. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  6. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →