TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2805 1.98K
На OpenRouter за неделю приехало пять моделей, о которых ещё не писал. Коротко о каждой, а на картинке индексы Artificial Analysis и скорость выдачи: три новинки рядом с GPT 5.6 Sol как ориентиром и с близкими по классу Luna, Gemini 3.5 Flash-Lite и Haiku 4.5.

Mercury 2.5 Preview от Inception, диффузионная LLM: пишет не по токену, а параллельно блоками, отсюда заявленные 1107 токенов в секунду на обычных GPU; медиана по замерам OpenRouter пока 105, на уровне Haiku 4.5, а Gemini 3.5 Flash-Lite там выдаёт 287. Появился режим рассуждений с уровнями, контекст 260 тысяч. По словам Inception, модель прибавила больше 10 баллов к Mercury 2 и держится на уровне GPT 5.6 Luna на низком усилии и Haiku 4.5; независимого замера у 2.5 пока нет, на графике стоит прошлая Mercury 2 с индексом 21,9, то есть обещанные плюс 10 выведут её к уровню Haiku 4.5. До 8 сентября скидка 80%: 0,04 $ за млн входных токенов и 0,15 за выходные, дальше 0,20 и 0,75.

Granite 4.2 8B от IBM, плотная модель с рассуждениями, обучена с нуля на 15 трлн токенов, контекст 128 тысяч с расширением до 512. Единственная из пятёрки с полной таблицей замеров IBM, но до флагманов ей далеко: индекс интеллекта 19,6 против 29,9 у Haiku 4.5, агентный всего 9: модель под дешёвые массовые задачи, а не под агентов. Apache 2.0, веса лежат на HuggingFace, в API 0,10 $ и 0,15 $ за млн.

Ling 3.0 Flash Fin от Ant Group, финансовая версия Ling 3.0 Flash: MoE, 5,1 млрд активных из 124, заточена под инвестиционные задачи с длинным планированием. Бесплатно, контекст 262 тысячи; бенчмарков и весов именно этой версии нет, базовая Ling 3.0 Flash набирает 37,8 индекса.

Две видеомодели. Wan 3.0 Prime от Alibaba, быстрый режим Wan 3.0: текст и первый кадр в видео, от 480p до 1080p, клипы от 2 до 30 секунд со звуковой дорожкой, 0,068 $ за секунду в 480p и 0,28 в 1080p. Hailuo 3 Max, дообученная вместе с fal.ai версия MiniMax H3: управление первым и последним кадром, 480p и 768p, 5–15 секунд, 0,05 и 0,08 $ за секунду, то есть дешевле самой H3 при 768p. По качеству fal обещает лучшее следование промпту и картинку, независимых замеров пока нет.

@neuro_channel
  • 👍 6
  • 👀 4
  • ❤ 2
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токен…
  5. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  6. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →