TGViewer
Тест Тьюринга Тест Тьюринга @testuring · 2.13K subscribers
Post #2240 321
🖥 Опенсорс как страховка от произвола БигТеха

Неделю назад правительство США впервые в истории приказало Anthropic отключить Fable и Mythos для всех неграждан США. Компания не смогла технически разделить пользователей и закрыла доступ для всего мира. Прецедент создан, и теперь если паттерн повторится для Sonnet или Opus, неамериканские пользователи Claude Code могут мгновенно остаться без инструмента.

На этом фоне три новые открытые модели выглядят как альтернатива или страховка:

1⃣ MiniMax M3: 428 млрд параметров, активных 23 млрд, 1 млн токенов контекста. Главная инновация — это MiniMax Sparse Attention, что дает экономию в 20 раз по вычислениям на больших контекстах, чем это было у предыдущего поколения.

3⃣ Kimi K2.7 Code: 1 трлн параметров, 32 млрд активных, 256 тыс. токенов контекста. Модель от Moonshot AI, реально открытые веса на HuggingFace под лицензией Modified MIT. Тратит на ~30% меньше токенов на размышление, чем у предыдущей версии K2.6.

3⃣ MiMo Code: форк популярного open-source агента OpenCode с собственной моделью MiMo-V2.5-Pro на 1 трлн параметров, временно бесплатной через анонимный режим без настройки. Поддерживает долговременную память проекта, голосовой ввод, совместим с навыками и командами Claude Code.

Что значит «открытые веса» на самом деле?

«Открытые веса» — это файлы с обученными параметрами модели, которые можно скачать и запустить на своём оборудовании без участия компании-разработчика.


Оговорка — для топовых моделей из этой тройки «своё оборудование» означает не домашний компьютер. По тестам независимых обзорщиков, 256-гигабайтный Mac способен запустить ужатую версию с заметной потерей качества, а для практичной интерактивной работы нужны минимум 8 видеокарт уровня H100. Это серверный кластер ценой в десятки тысяч долларов.

Открытые веса дают возможность кому-то развернуть модель и предложить доступ другим. Для обычного человека открытые веса практически означают «появился дешёвый облачный API», а не «можно запустить на ноутбуке».

Что реально доступно прямо сейчас?

Облачный API через агрегаторы вроде OpenRouter — это самый реалистичный путь. MiniMax M3 на старте стоила $0,30 за миллион токенов на входе и $1,20 на выходе. Kimi K2.7 Code — $0,95/$4,00 за миллион токенов. Для сравнения, Claude Sonnet 4.6 стоит $3/$15 за миллион токенов.

MiMo Code — самый простой вариант для старта: команда curl -fsSL https://mimo.xiaomi.com/install | bash ставит инструмент, режим MiMo Auto работает бесплатно и без настройки.

Что говорят бенчмарки?

Здесь данные расходятся в зависимости от того, кто их публикует. MiniMax сама заявляет 59% на SWE-Bench Pro — это ниже, чем у Opus 4.8, но некоторые независимые агрегаторы дают MiniMax M3 80,5% на SWE-bench Verified против 72,7% у Sonnet 4.6. Разброс в 17–21 пункт между разными методиками тестирования — это норма: модель показывает разные результаты в разных обвязках.

Kimi K2.7 по независимому обзору Flowtivity достигла 60,4% на SWE-bench Verified — новый максимум среди открытых моделей, и обогнала Opus 4.8 по точности вызова инструментов через MCP.

Отдельное исследование Kili Technology показало: между лабораторными бенчмарками и реальной работой агентов разрыв в среднем составляет 37%.


Удобство и реальные отзывы

Взгляд независимого теста VentureBeat особенно интересен. Одну и ту же модель MiMo-V2.5-Pro прогнали через два разных движка: фирменный MiMo Code и Claude Code. MiMo Code показал 62% на SWE-bench Pro против 57% у Claude Code. Разница пришла не от модели, а исключительно от того, как агент организует работу. На задачах длиной более 200 шагов MiMo Code, по заявлению Xiaomi, не входит в "петли галлюцинаций", в которые попадает Claude Code.

Вывод

Реалистичный сценарий для нетехнического пользователя — подключить дешёвый API через OpenRouter или поставить MiMo Code и пользоваться бесплатным режимом. Это не равноценная замена Claude Code по качеству на сложных задачах, но это работающая страховка на случай, если завтра доступ к Claude станет недоступен без американского паспорта.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
More from @testuring
  1. Sep 23, 2026ИИ, который не умеет генерить текст и картинки, но зато умеет выбирать Соавтор статьи об I…
  2. Sep 22, 2026🧪 Новый инструмент проверки научных гипотез AlphaXiv выпустила OpenResearch — открытую ра…
  3. Sep 21, 2026👿 Новости из Японии: снова оркестрация вместо одной гигантской ИИ-модели 11 сентября япон…
  4. Sep 18, 2026⚠️ ИИ уже нарушает правила, которые люди только начинают писать На этой неделе произошло с…
  5. Sep 17, 2026⚡️ Новая мировая линейка неравенства между государствами будет измеряться токенами China T…
  6. Sep 16, 2026🔐 У искусственного интеллекта появляется технадзор Сразу две новости, вышедшие за последн…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →