TGViewer
Big Data AI Big Data AI @bigdatai · 18.2K subscribers
Post #1872 1.58K

Forwarded from Machinelearning

🌟 Релиз диффузионной LLM от Google

DiffusionGemma - экспериментальная языковая модель с открытыми весами, которая заимствовала подход из генерации изображений, где диффузионные модели превращают шум в картинку.

Модель построена на семействе Gemma 4, а сам механизм диффузии восходит к более ранней разработке Gemini Diffusion.

Под капотом MoE на 26 млрд общих и 3,8 млрд активных параметров. После квантования модель умещается в 18 ГБ VRAM.

По словам Google, на одном GPU модель работает до 4 раз быстрее сопоставимой авторегрессионной модели.

Nvidia приводит около 1000 токенов в секунду на H100, 150 - на DGX Spark и до 800 - на DGX Station.

Google заявляет более 700 токенов в секунду на GeForce RTX 5090.


На устройствах с общей памятью (например на Apple Silicon) разница с обычными моделями, вероятно, окажется меньше, а в облаке с параллельными запросами преимущество вовсе исчезает - в этом сценарии диффузия может повышать издержки.

🟡За скорость приходится платить качеством

Для задач, где оно критично, Google по-прежнему рекомендует обычные модели Gemma 4, а DiffusionGemma позиционирует как инструмент для исследователей и разработчиков.

Сильной стороной компания называет задачи, не предполагающие строго последовательного порядка: вставку текста в готовый абзац, заполнение пропусков в коде, работу со структурированными данными.

🟡Доступность

Веса опубликованы на Hugging Face под Apache 2.0. Модель работает с Transformers, vLLM и MLX.

Запустить её можно также через Model Garden и Nvidia NIM, а бесплатно потестить на build.nvidia.com.

Для дообучения предлагаются собственный JAX-тулбокс Hackable DiffusionUnsloth и NeMo от Nvidia.

Google собрала руководство для разработчиков, а Маартен Гроотендорст - визуальное объяснение работы модели.


@ai_machinelearning_big_data

#news #ai #ml
  • ❤ 4
More from @bigdatai
  1. Sep 22, 2026WebCraftBench проверяет сайты, созданные ИИ Агент говорит, что сайт готов. Но главная стра…
  2. Sep 18, 2026🔥 Ternary представила Bonsai 2 27B - тернарную версию Qwen3.8 27B размером всего 5,9 ГБ.…
  3. Sep 17, 2026Во время выполнения обычной задачи по программированию ChatGPT 6 Astra неожиданно начала п…
  4. Sep 16, 2026🔥 Один из лучших обучающих курсов на StepiK по SQL SQL можно знать годами и всё равно тер…
  5. Sep 15, 2026🎙 Google выпустила Gemini 3.8 Live и Live Extended Thinking Модели поддерживают 97 языков…
  6. Sep 15, 2026Участвуй во всероссийском ИТ-чемпионате МТС True Tech Champ 2026 c призовой фондом 10 250…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →