
近期,全球最大AI模型聚合平台OpenRouter发布的周度Token(词元)调用量榜单,释放出一个清晰的信号:8月3日至9日当周,榜单头部被国产大模型包揽前四,正以强劲势头抢占全球开发者市场。本轮榜单中,DeepSeek-V4-Flash正式版首次登顶榜首,腾讯Hy3、Deep-Seek-V4-Flash预览版、小米MiMo-V2.5依次位列二至四名,第五名为海外模型Luna。
据OpenRouter最新测算,当期全球AI大模型总调用量达69万亿Token,环比增长21.48%。其中,上榜的国产AI大模型周调用量高达34.25万亿Token,环比增长21.76%,增速略高于全球平均水平。
国产AI模型加速突围
Agent需求成新引擎
从更长周期看,中国模型在OpenRouter平台的月度Token份额已由2025年1月的6.0%飙升至2026年7月的61.5%,占比提升超十倍。国信证券研报数据显示,OpenRouter平台月度日均Token调用量从2025年1月的0.072T增长至2026年7月的7.995T,平台整体规模呈指数级扩张。最新前十大模型中,7个来自中国厂商,国产AI大模型已在第三方聚合平台的开发者调用赛道实现显著领先。
增长动力的迁移同样值得关注——推理需求正由简单聊天向复杂工作流升级。数据显示,Agent与Coding类应用仅占应用数量的19%,却贡献了81.2%的Token用量,表明智能体化任务正在成为驱动推理需求高速扩张的新引擎。业内认为,推理需求扩张叠加模型快速轮换,有望推理需求进入高速扩张期。
DeepSeek-V4-Flash登顶
性价比叠加技术矩阵成关键
在8月3日至9日当周的热度榜单中,DeepSeek-V4-Flash正式版首次登顶居首,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位列第二,周调用量8.05万亿Token,环比增长67%;DeepSeek-V4-Flash预览版排名第三,周调用量5.88万亿Token;小米MiMo-V2.5位列第四位,周调用量5.39万亿Token。此外,OpenAI的GPT-5.6Luna进入第五位,周调用量4.43万亿Token。国产大模型已形成从经济适用型到旗舰大参数型的完整产品矩阵,覆盖不同开发需求。
中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙在接受媒体采访时分析,DeepSeek登顶的直接原因是V4Flash正式版上线,将预览版的能力验证转化为稳定的商用服务。极致性价比叠加智能体需求放大效应是关键因素——该版本官方价格为每百万Token输入1元、输出2元。据悉,正式版上线后,单日使用量和合作平台新订阅用户均增长约30%。
在技术层面,国产大模型已扩展到全链路工程能力。以DeepSeek-V4-Flash为例,通过混合专家(MoE)、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间形成平衡;小米MiMo-V2.5、腾讯Hy3、Deep-Seek-V4-Pro及智谱GLM-5.2分别在多模态、代码生成、长程规划和复杂推理等方向上形成互补。钟新龙表示,国内企业能够快速完成灰度测试、正式发布、接口迁移和多平台分发,将技术进步迅速转化为全球开发者的实际调用。
从API低价竞争
到高附加值延伸
在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。
同时,调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。随着智能体应用的不断渗透和推理需求的结构性升级,国产大模型有望在全球市场竞争中占据更有利的位置。 华商报大风新闻记者 胡宇宁
华商网版权与免责声明:
② 部分内容转载自其他媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责。
③ 如因作品内容、版权和其他问题需要同本网联系的,请在30日内进行。
联系方式 新闻热线:029-86519800