TGViewer
Вайб-кодинг Вайб-кодинг @vibecoding_tg · 63K subscribers
Post #3713 23.2K
Qwen3.8-27B теперь работает со скоростью 70 токенов/с прямо на ноутбуке.

Вышел DFlash 2 — новое поколение спекулятивного декодирования на основе блочной диффузии.

DFlash 2 разгоняет Qwen3.8-27B до 70 токенов/с на MacBook Pro с M5 Max. Ускорение авторегрессионного декодирования достигает 4,6 раза, а итоговый вывод остаётся полностью идентичным исходной модели — буквально ни одного отличающегося токена. ⚡️

Уже доступны новые черновые модели для Qwen3.8-27B с нативной поддержкой SGLang, vLLM, llama.cpp и oMLX.

Суть подхода: https://inco.ai/blog/dflash2/
More from @vibecoding_tg
  1. Sep 23, 2026Пользователи Gemini на этой неделе:
  2. Sep 23, 2026Это нарисовал не человек 😨 Claude Opus 5.5 написала код, который покадрово создал эту ани…
  3. Sep 23, 2026Post #3930
  4. Sep 22, 2026И OpenAI подтянулась с новым релизом: встречайте GPT-6 Sol и Luna Sol стала примерно вдвое…
  5. Sep 22, 2026Claude Opus 5.5 уже вышла и обходит Fable 5.1 и GPT-6 Astra в большинстве бенчмарков. 🦀 П…
  6. Sep 22, 2026GPT-6 Sol и GPT-6 Luna готовятся к выходу. Модели уже находятся на финальном этапе подгото…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →