TGViewer
Machine learning Interview Machine learning Interview @machinelearning_interview · 30.3K subscribers
Post #2966 4.7K
🔥 Qwen3.8-Flash теперь можно запускать локально

125B MoE-модель доступна в GGUF от Unsloth и может работать примерно на 75 ГБ RAM.

Qwen3.8-Flash-Next рассчитана в том числе на CPU RAM и unified memory, позволяя получать скорость, близкую к работе из VRAM.

По заявленным результатам модель обходит Claude Opus 4.6 Max в ряде тестов.

Гайд:
https://unsloth.ai/docs/models/qwen3.8-next

GGUF:
https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
  • ❤ 18
  • 👍 8
  • 🥴 6
  • 🔥 2
  • 😭 1
More from @machinelearning_interview
  1. Sep 21, 2026SoftBank привлекает более $11 млрд ради новой инвестиции в OpenAI 🚨 SoftBank запустила ра…
  2. Sep 21, 2026Один вечер — много возможностей! ⚡️ 25 сентября у тебя будет шанс познакомиться сразу с че…
  3. Sep 21, 2026🔥 Hemmingway-1 - открытая модель, которая пытается писать как человек Модель построена на…
  4. Sep 20, 2026💰 Инвесторы допускают оценку Anthropic в $4 трлн после IPO, но дешёвые модели усиливают д…
  5. Sep 18, 2026photo post
  6. Sep 18, 202617 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создат…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →