历史性反超:中国AI模型调用量首超美国,MiniMax、Kimi、GLM-5、DeepSeek霸榜全球前五

3.1 MiniMaxM2.5DeepSeekV3阿里Qwen3.5均采用quot总参数万亿级激活参数百亿级quot的稀疏设计,将推理成本降至传统密集模型的110

2月27日,全球最大API平台OpenRouter数据显示,2026年2月中国AI模型的周调用量首次超越美国,并于次周冲高至5.16万亿Token,三周内激增127%。更震撼的是,全球调用量前五的模型中,中国占据四席——MiniMax M2.5、月之暗面Kimi K2.5、智谱GLM-5、DeepSeek V3.2,合计贡献Top 5总调用量的85.7%。


20260301

 

数据背后的"中国速度"

 

  • 2月9-15日:中国模型Token调用量4.12万亿,首超美国的2.94万亿

  • 2月16-22日:中国模型冲高至5.16万亿,美国跌至2.7万亿

  • 增速对比:中国三周大涨127%,美国同期下滑8%

  • 市场份额:一年前中国模型占比不到2%,如今跃升至66%

 

MiniMax M2.5:单月冠军的"极致性价比"

 

发布仅两周的MiniMax M2.5,以4.55万亿Token调用量拿下OpenRouter单月冠军。其核心优势在于"1美元运行1小时"的极致定价——价格仅为GPT-5的1/20,但性能比肩Claude Opus。这种"性能对标、价格屠榜"的策略,正在重新定义全球AI基础设施的成本基准。

 

技术密码:MoE架构与成本优势

 

中国模型的集体崛起,离不开"混合专家架构(MoE)"的效率革命。MiniMax M2.5、DeepSeek V3、阿里Qwen3.5均采用"总参数万亿级、激活参数百亿级"的稀疏设计,将推理成本降至传统密集模型的1/10。这种"以小博大"的工程创新,使中国模型在全球API市场形成"降维打击"。

 

战略意义:从"技术跟随"到"生态输出"

 

OpenRouter的数据标志着中国AI的范式转变:

  • 过去:跟随OpenAI、Google的技术路线,做"国产替代"

  • 现在:定义"极致性价比"的新标准,成为全球开发者的"默认选择"

 

当美国开发者开始主动选择MiniMax、Kimi而非GPT-5,中国模型已完成从"备胎"到"主选"的跨越。这种"生态输出"能力,比单纯的技术参数更具战略价值。