数据中心,正在拆掉Token时代的旧围墙
(本文作者为 硅碳变量,钛媒体经授权发布)
> 文|硅碳变量,作者|沈浪
9月17日,在2026 ITValue Summit数字价值年会上,超聚变算力领域副总裁王梁栋指出,伴随大模型能力加速演进,AI进入推理为主的“干活”时代,全球Token消耗将持续爆发,促使AI基础设施同步进化。
当下算力行业的竞争逻辑正在迭代,单纯依靠堆叠服务器和扩张硬件规模的粗放式发展路径,效用持续减弱。
随着AI重心从模型训练转向海量推理,算力基础设施正在经历底层变革,传统“堆硬件、扩规模”的建设思路,越来越难以匹配新阶段的产业需求。
TOKEN的真实账单
Token不是噱头,是AI产业正在面对的真实账单。
当市场还在热议大模型参数、评测榜单这些显性指标时,一组持续攀升的Token调用数据正在揭示AI产业底层逻辑的转向:算力价值的重心正从一次性训练的峰值能力,向持续不断的推理开销迁移。
3月23日召开的中国发展高层论坛2026年年会透露,今年3月,中国日均Token调用量突破140万亿,相比2024年初的1000亿,两年增长超千倍。同月,中国AI大模型周Token调用量连续三周超越美国,成为全球 AI 应用活跃度最高的国家之一。
来自全球最大AI模型API聚合平台OpenRouter的数据,进一步印证国内AI应用端的爆发。3月16日至22日,全球AI大模型总Token调用量为20.4万亿,仅中国就达7.359万亿,占全球的36%。
国内海量企业应用与智能体场景的规模化落地,正在推高Token消耗,让国内调用规模站上全球高位。
面向未来,多家机构给出了极具冲击力的预测数字。根据摩根大通的最新预测,中国AI推理Token消耗量将从2025年的约10千万亿增长至2030年的约3900千万亿,五年间增长约370倍。
IDC的判断则更为大胆,全球年度Token消耗量将从2025年的0.0005 Peta Token增长至 2030年的15万Peta Token,年复合增长率高达3418%;到2031年,全球活跃智能体数量将达到3.5亿个,而单智能体Token消耗量可达传统对话应用的百倍乃至千倍级。
...
硅碳变量 | tmtpost.com • Oct 8, 2026
Post #9616
2
