TGViewer
Кот Денисова Кот Денисова @itdenisov · 229 subscribers
Post #250 589
👨‍💻 Гонка за самую мощную ИИ-модель подходит к концу?

Последние несколько лет за развитием генеративного ИИ было удобно следить как за спортивной таблицей. OpenAI выпускала GPT-4, Google отвечала Gemini, Anthropic показывала новую Claude, затем начинался следующий круг. Каждая компания приносила набор бенчмарков и объясняла, где ее модель теперь первая.

В 2026 году эта логика начала ломаться. Не потому, что модели перестали становиться мощнее. Наоборот, 1 сентября Anthropic выпустила Claude Fable 5.1 - новую топовую модель для программирования и сложной интеллектуальной работы. Проблема в другом: возможность построить более сильную модель больше не означает, что большинство клиентов захотят использовать ее для большинства задач.


Что показывают цифры:

Financial Times обратила внимание на показательный пример. Fable 5 вышла 9 июня 2026 года как одна из самых мощных моделей Anthropic. Спустя примерно два месяца на нее приходилось около 11% расходов на продукты Anthropic среди корпоративных клиентов.

Это не 11% всей выручки Anthropic, а показатель внутри конкретной выборки корпоративных расходов. Кроме того, доступ к модели был отключен 12 июня из-за американских экспортных ограничений, а глобальный релиз восстановили 1 июля. Цифра не идеальна. Но сама тенденция интереснее конкретных 11%. Компании все чаще выбирают более дешевые модели, если дополнительное качество frontier-модели не влияет на результат.


Что изменилось к 2026 году:

Разница между классами моделей стала огромной. Claude Sonnet 5 стоит $2 за миллион входных и $10 за миллион выходных токенов. Fable 5.1 - $10 и $50 соответственно.

Fable нужна там, где дополнительная вычислительная мощность действительно меняет результат: сложное программирование, длительная агентная работа, научные задачи. Но использовать ее для классификации обращений или извлечения данных из документов экономически бессмысленно, если Sonnet справляется достаточно хорошо.

В релизе Fable 5.1 Anthropic рассказывает не только о новых результатах на тестах, но и о снижении стоимости cache reads на 75%. То есть даже релиз самой мощной модели теперь приходится объяснять через экономику ее эксплуатации.


На смену лидербордам приходит оркестрация:

Perplexity делает ставку на multi-model orchestration. Разные модели используются внутри одной системы и получают те части работы, для которых подходят лучше. В 2026 году Perplexity развивает Model Council - один запрос может параллельно отправляться нескольким моделям, после чего отдельный слой сравнивает ответы и формирует итоговый результат.

Для прода именно оркестрация становится важнее, чем выбор модели. Нужно решить, какие запросы требуют дорогого inference, когда включать reasoning, сколько контекста передавать, где использовать кеш, когда переключаться на другого провайдера.

Хорошая оркестрация может влиять на стоимость и качество продукта сильнее, чем очередная замена одной frontier-модели на другую.


Так гонка закончилась или нет:

На исследовательском уровне нет. OpenAI, Google, Anthropic, xAI, DeepSeek продолжат выпускать более сильные модели. Frontier по-прежнему важен: именно там появляются возможности, которые позднее становятся дешевле и переходят в массовые модели.

Заканчивается другая гонка: попытка использовать одну максимально мощную модель как универсальный ответ на все задачи.


🔗 Читать подробнее


💡 Вывод:

К 2026 году рынок раздробился. Есть быстрые модели, reasoning-модели, системы с огромным контекстом, open-weight решения, специализированные модели и архитектуры, которые автоматически переключаются между несколькими вариантами.

Позиция в одном лидерборде все хуже описывает реальную ценность модели. Для прода гораздо важнее соотношение качества, стоимости и задержки.

Максимальный интеллект остается ценным ресурсом, но использовать его на каждом запросе больше нет смысла. Вопрос сместился с «какая модель лучше?» на «какая минимальная модель достаточно хороша для этой задачи?». И это, вероятно, главный итог четырехлетней гонки.


Подписаться на канал:
➡️ Кот Денисова
  • 👍 4
  • 👀 1
More from @itdenisov
  1. Sep 30, 2026👨‍💻 Почему разработчики стали маркетологами. Есть метрика time to market - количество вр…
  2. Sep 23, 2026👨‍💻 Скорость разработки перестала быть дефицитом. Дефицитом стали доходные идеи. ИТ-мене…
  3. Sep 16, 2026👨‍💻 Команды Git, которые полезно знать. Когда вы уже хорошо знакомы с командами add, com…
  4. Sep 2, 2026👨‍💻 Почему ПМ игнорирует мнение разработчика и спрашивает других? Знакомая ситуация. Вы…
  5. Aug 26, 2026👨‍💻 Навыки прохождения собеседований стали важнее реального опыта. В последние годы в ИТ…
  6. Aug 19, 2026👨‍💻 Почему слабые руководители боятся сильных сотрудников. В каждой компании есть сотруд…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →