TGViewer
AI Projects AI Projects @turboproject · 11.2K subscribers
Post #5207 2.8K
📊 Arena сделал предварительную оценку MiMo-V2.6-Pro, хотя модель на уровне Claude Fable 5 (High), как и Qwen3.8 Flash Next во фронтах, но можно уже сказать, что MiMo-V2.6-Flash не получится заметно опередить DeepSeek V4.1 Flash, что было критично.

Дело в том, что хотя DeepSeek V4.1 Flash формально на 16 месте, а glm-5.3-flash на 17-м, но у них оценки около 1610 баллов, а у MiMo-V2.6-Pro — 1628. В баллах Elo разница 50–100 баллов — это серьёзно, т. е. другой уровень. Однако 10–15 баллов — это уровень статистической погрешности измерений.

На деле все китайские «флешки» примерно на одном уровне, поэтому важнее скорость и цена. У DeepSeek V4.1 ещё очень важный аргумент именно по скорости.
  • 👍 16
  • ❤ 4
More from @turboproject
  1. Sep 22, 2026🚀 Похоже, Дарио выигрывает этот раунд у Альтмана и может идти на IPO спокойно. Opus 5.5 с…
  2. Sep 22, 2026🔄 Обновились OpenAI и Anthropic, давайте смотреть. У Anthropic давно заброшен Haiku и сво…
  3. Sep 22, 2026🎬 Обсудим, какие есть методы апскейла видео, совместимые с архитектурой Blackwell в RTX 5…
  4. Sep 22, 2026🔍 К спорам в чате: сделан ли Jev на ModernBERT или нет. Большинство экспертов считают, чт…
  5. Sep 22, 2026🚩 Сейчас идёт настоящий бум Decision-моделей. В топе Hugging Face совсем не Qwen или Deep…
  6. Sep 22, 2026📊 На OpenRouter уже можно посмотреть статистику моделей. Можно оценить «какая флешка лучш…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →