《每日经济新闻》根据OpenRouter最新数据测算,上周(8月3日至8月9日)全球AI大模型总调用量为69万亿Token,环比增长21.48%。

其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。

《每日经济新闻》注意到,上周,全球调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量达5.88万亿Token,环比下滑19%;小米MiMo-V2.5掉到第四,周调用量达5.39万亿Token,环比下滑14%。

7月31日,DeepSeek宣布,DeepSeek-V4-Flash正式版API上线公测。据了解,DeepSeek-V4-Flash正式版的模型结构、尺寸和DeepSeek-V4-Flash预览版保持一致,仅重新进行后训练。据官方更新日志显示,V4-Flash正式版在Agent能力上大幅增强,基准测试远超预览版本。

据Artificial Analysis测算,V4-Flash正式版完成单项测试任务的平均成本约为0.03美元,只有Anthropic旗舰模型Claude Fable 5的1/100,成为目前全球主流模型中成本最低的模型。

OpenAI旗下GPT-5.6 Luna进入前五,周调用量达4.43万亿Token,环比增长128%。

7月10日,OpenAI正式公开发布GPT-5.6系列模型,而GPT-5.6 Luna是该系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程。该系列模型上线不到三周之际,OpenAI宣布优化GPT-5.6系列模型定价和性能,以提升企业用户AI应用的性价比。其中,GPT-5.6 Luna模型价格下调80%。

谷歌Gemini 3.6 Flash首次进入榜单,排名第九,周调用量达2.33万亿Token,环比增长446%。

Gemini 3.6 Flash于7月22日发布。第三方测评机构Artificial Analysis Index的数据显示,Gemini 3.6 Flash在输出时消耗的token数量比上一代Gemini 3.5 Flash平均减少了17%。

其每百万输入Token价格保持在1.50美元,输出价格则由上一代的9美元降至7.50美元,降幅约16.7%。

值得注意的是,此前一周排名第七的MiniMax M3和排名第九的阶跃星辰Step 3.7 Flash跌出榜单。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。