TGViewer
immers.cloud | Облако с GPU immers.cloud | Облако с GPU @immers_cloud · 944 subscribers
Post #1219 589
Qwen3.6-35B-A3B: зачем нужна MoE-версия

👋 Qwen3.6-35B-A3B — модель семейства Qwen3.6, которая близка к Qwen3.6-27B по назначению, но отличается архитектурным подходом.

Что важно:
▪️ MoE-архитектура
Модель использует 256 экспертов, из которых для каждого токена выбираются 8. Это позволяет сочетать качество крупной модели с более низкой вычислительной нагрузкой при инференсе.

▪️ Отличие от Qwen3.6-27B
По бенчмаркам Qwen3.6-35B-A3B уступает Qwen3.6-27B, но за счёт MoE и меньшей нагрузки на KV-cache может быть быстрее и экономичнее в ряде сценариев инференса, особенно при длинных многошаговых задачах.

📲 Подробнее — в слайдах.

➡️ Развернуть Qwen3.6-35B-A3B можно в immers.cloud и проверить модель на реальных задачах с оплатой за GPU-ресурсы, а не за отдельные токены.
  • ❤ 4
  • 🔥 4
  • 👍 2
  • ⚡ 1
More from @immers_cloud
  1. Sep 22, 2026📢 Глава Anthropic призвал замедлить развитие ИИ 📰 Дарио Амодеи опубликовал эссе «We Must…
  2. Sep 16, 2026Сравнительный анализ инференса модели openai/gpt-oss-20 на RTX 4090 и H100 NVL Что важно:…
  3. Sep 13, 2026Поздравляем разработчиков с профессиональным праздником ❤️ Работа программиста — это не то…
  4. Sep 11, 2026GLM-5.3 — текстовая MoE-модель семейства GLM-5 от Z.ai с 753 млрд параметров (около 40 млр…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →