TGViewer
AI Projects AI Projects @turboproject · 11.2K subscribers
Post #5194 2.95K
Многие эксперты считают, что данные AI Gateway от Vercel более репрезентативно показывают состояние рынка ИИ сейчас, чем OpenRouter. Видно, что китайцы выигрывают в плане контроля над рынком в токенах, а американцы — в деньгах.

Сейчас модели с открытыми весами составляют 78,4% от объёма токенов, по сравнению с всего 21,6% для закрытых моделей, в то время как открытые модели представляли примерно 40% объёма токенов в июне, что означает, что их доля почти удвоилась всего за три месяца.

DeepSeek V4.1 Flash в одиночку генерирует 59,3% токенов, проходящих через шлюз, а в сравнении с Claude его Opus 4.8 генерирует всего 1,7% объёма токенов.

Однако данные о расходах рассказывают совсем другую историю. Закрытые модели всё ещё захватывают непропорционально большую сумму денег за свои токены. Claude Opus 4.8 составляет 13,7% расходов, несмотря на то что представляет всего 1,7% объёма токенов, в то время как пять перечисленных моделей Claude от Anthropic в совокупности захватывают 36,9% общих расходов. DeepSeek V4.1 Flash имеет противоположный профиль: он обрабатывает большинство токенов на шлюзе, но составляет всего 5,1% расходов.

Важный момент: китайские модели не работают в убыток. Уровень маржинальности китайских моделей выше американских. The Information указывает, что маржа DeepSeek 70–80%. Для сравнения у Claude — 50%. Причём если вычесть затраты на обучение, как указывает Дарио. Однако тут тоже сильно изменён спектр расходов. Известно, что китайским моделям нужно всего несколько миллионов долларов на обучение их LLM на готовых датасетах. Последний пример — обучение новой модели Xiaomi в прямом эфире, которое я публиковал ранее (https://mimo.xiaomi.com/rl/). Там хорошо видно, что Pro-модель по аренде GPU обучается за несколько миллионов долларов всего. Это немыслимая для американцев эффективность обучения и инференса моделей.

Тем не менее OpenAI и Anthropic смогли создать устойчивый бизнес «тяжёлых фронтиров», которые принимают самые сложные проектные решения. Многие эксперты в X сейчас уже отказались от американских моделей для worker-агентов, но пишут что-то в духе: «DeepSeek у меня 90% потребления токенов, а Claude только 10%, но 90% реальных решений, которые мне принесли деньги, делает Claude».

Важный аспект: китайцы, оккупировав уже массовый рынок «рабочих агентов», уже успешно проникли даже в ключевых клиентов Anthropic и OpenAI. Корпоративу ещё важно поставить LLM локально, чтобы Альману и Дарио не сливать все свои секреты.

Однако вряд ли китайцы дадут возможность американцам спокойно чувствовать себя в сегменте тяжёлых моделей после разгрома американцев в бюджетных LLM. Скорее всего, мы сейчас увидим снова набеги тяжёлых китайских LLM в духе Kimi K3 или Qwen 3.8 Max, которые будут оспаривать самые топовые модели OpenAI и Anthropic.

Из ближайших тяжёлых моделей ожидается выход DeepSeek V5. По слухам в X Лян Вэньфэн решил назвать DeepSeek V4.1 с пересмотренной концепцией трансформеров лишь «4.1», чтобы не портить имидж «пятёрки», которая должна побороться с Astra и Fable. Посмотрим, что у него выйдет.
  • ❤ 26
  • 👍 12
  • 🔥 1
More from @turboproject
  1. Sep 22, 2026🚀 Похоже, Дарио выигрывает этот раунд у Альтмана и может идти на IPO спокойно. Opus 5.5 с…
  2. Sep 22, 2026🔄 Обновились OpenAI и Anthropic, давайте смотреть. У Anthropic давно заброшен Haiku и сво…
  3. Sep 22, 2026🎬 Обсудим, какие есть методы апскейла видео, совместимые с архитектурой Blackwell в RTX 5…
  4. Sep 22, 2026🔍 К спорам в чате: сделан ли Jev на ModernBERT или нет. Большинство экспертов считают, чт…
  5. Sep 22, 2026🚩 Сейчас идёт настоящий бум Decision-моделей. В топе Hugging Face совсем не Qwen или Deep…
  6. Sep 22, 2026📊 На OpenRouter уже можно посмотреть статистику моделей. Можно оценить «какая флешка лучш…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →