新芒xAI 8月10日消息,OpenRouter最新数据测算显示,8月3日至8月9日一周,其统计口径下全球AI大模型总调用量达到69万亿Token,环比增长21.48%。其中,上榜中国AI大模型周调用量为34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量已连续十五周超过美国。
关键要点
本周调用量排名前四均为中国AI大模型。DeepSeek-V4-Flash-0731,即DeepSeek-V4-Flash正式版,位居第一,周调用量达到8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量为8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423预览版排名第三,周调用量为5.88万亿Token,环比下滑19%。
这组数据延续了今年以来中国开源和高性价比模型在开发者调用市场的上升趋势。OpenRouter此前也曾在公开博客中提到,DeepSeek V4系列在智能体工作负载和成本效率上获得了更多Token流量,部分中国模型正在从低成本替代方案进入更高频的生产调用场景。
需要注意的是,OpenRouter数据反映的是其平台和榜单统计口径下的Token流向,不能直接等同于全球全部AI应用市场份额。Token调用量也不等同于收入、利润或模型综合能力,低价模型往往更容易拉高Token规模,但商业价值仍要看用户留存、企业付费、复杂任务表现和生态黏性。
新芒xAI评论
中国大模型连续十五周在调用量上领先,说明竞争焦点正在从“是否能追上前沿能力”扩展到“能否被开发者高频调用”。在API和智能体工作流里,成本、速度、上下文长度、稳定性和工具调用效果,往往会共同决定模型是否真正进入生产链路。
DeepSeek-V4-Flash正式版环比大增,背后既有正式版发布后的迁移效应,也可能与其价格和响应效率有关。腾讯Hy3继续处在前列,则说明国内大厂模型正在通过产品、云服务和开发者生态承接更多实际调用需求。
但调用量领先不应被简单理解为技术全面领先。高端科研推理、多模态创作、复杂Agent可靠性和企业级合规仍是前沿模型竞争的核心战场。对国产模型而言,接下来真正关键的是把Token规模转化为可持续收入、可信赖的企业场景和更强的开发者生态,而不是只停留在榜单上的流量优势。