Симуляция Revenue рынка ИИ-токенов к 2030г. + масштаба дата-центров [ GW ]
Уменьшение Цена / Токен:
2023 - 2024 [ -x3 ]
2024 - 2025 [ -x3 ]
2025 - 2026 [ -x2.5 ]
——————————————————————
Рост общего спроса на токены:
2024 - 2025 [ ~x8 ]
2025 - 2026 [ ~x7 ]
Google увеличили потребление токенов в 50 раз за год [ 2025г. / Май ] - связано с использованием в внутренних продуктов
Microsoft увеличили потребление токенов в 5 раз за год [ 2025г. / Апрель ]
OpenAI увеличили потребление токенов в 8 раз за год [ 2025 г.. / Декабрь ]
OpenAI увеличили потребление токенов в Reasoning - моделях в 320 раз за год [ 2025 г.. / Декабрь ]
——————————————————————
Рост сложности вычислений на токен в разных моделях:
Обычный chat -x1 [ GPT 5.4 - 15$ ]
Продвинутый чат - x12 [ GPT 5.5 - 180$ ]
Reasoning Model c длинным контекстом - x18 [ GPT 5.5 pro - 270$]
AI Agent tokens - x25 [ Claude ] / x1000 [ Huang ]
Microsoft CEO : Агенты добавляют второй множитель сверху/ Reasoning — это «думает один раз дольше». Агент — это «думает много раз + использует tools». - > потенциальное увеличение спроса на токены в тысячи раз.
Средневзвешенная "цена за токен" в долларах падает медленнее, чем удельная стоимость генерации одного токена, потому что средний токен становится "тяжелее"
——————————————————————
Оптимизация эффективности J / token
( учтена оптимизация не только на уровне GPU - но и на уровне софта и иных решений ) :
Hopper H100 [ 2022 г. ] - 10 J/token
Blackwell GB200 [ 2024 г. ] -1 J / token [ x10 ]
Rubin J100 [ 2026 г. ] - 0.1 J / token [ x10 ]
NVIDIA после Rubin планирует выпуск новой архитектуры чипа каждый год.
Текущие 10–50× за поколение у NVIDIA - это эра, эквивалентная закону Деннарду в CPU 1990-х.
Когда «лёгкие выигрыши» исчерпаются (вероятно, 2030–2035), темп замедлится с 10× за поколение до 1,4–2× - как у CPU после 2005 г.
GPU в дата-центрах только 40% затрат на энергию и GWT / остальные 60% затраты на обеспечение дата-центра.
——————————————————————
Текущие вводные за 2026г. для симуляции сценария:
Revenue от ИИ токенов: 200B$ / год
Rubin J100 : 0.1 J / token
GWT под дата-центры 30 GWT [ из них 40% на GPU конкретно ]
Сценарий за 2030г.:
Большая часть токенов = reasoning / AI Agents модели [ рост доли их использования ]
Уменьшение PRICE / per Token: -x81
Рост спроса Tokens : x625
Рост сложности вычислений: x10
Оптимизация эффективности watt / token : 1000x
Итог:
Revenue ~ 1.54T$ / год
Цена за 1M tokens ~ 0.00065$
GPU мощность - 75 GW / Полная мощность ДЦ - 187 GW
Прогноз Goldman Sachs для AI к 2030 ~ 160 GW
Прогноз McKinsey для AI к 2030 ~220 GW
*оба прогноза близки к моей симуляции
Прогноз OpenAI по выручке к 2030 г. :280B$
[ в целом, если OpenAI будет владеть 20% общего объема рынка - то мой прогноз соответсвтует ]
Post #152
562

- ❤ 4
- 🎉 1