上周全球AI大模型总调用量环比增长,中国大模型表现亮眼,这些变化你知道吗?

上周全球AI大模型总调用量情况
整体增长态势
上周全球AI大模型总调用量为69万亿Token,环比增长21.48%。这显示出AI大模型在全球范围内的应用热度持续上升,对其需求不断增加。不同国家的大模型调用量也有各自的变化趋势。
中美大模型调用量对比
中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;美国同期为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位,体现了中国在AI领域的强劲发展态势。

上周中国AI大模型具体排名及变化
DeepSeek-V4-Flash正式版登顶
DeepSeek-V4-Flash正式版位居第一,周调用量达8.83万亿Token,环比增长570%。其增长幅度惊人,在众多模型中脱颖而出。腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%,也有不错的表现。
其他模型排名及变动
DeepSeek-V4-Flash-0423排名第三,周调用量达5.88万亿Token,环比下滑19%;小米MiMo-V2.5掉到第四,周调用量达5.39万亿Token,环比下滑14%。OpenAI旗下GPT-5.6Luna进入前五,谷歌Gemini3.6Flash首次进入榜单排名第九,部分模型跌出榜单,反映了模型竞争的动态变化。
部分模型的特点及优化情况
DeepSeek-V4-Flash正式版
7月31日上线公测,模型结构等与预览版一致但重新后训练。在Agent能力上大幅增强,基准测试远超预览版本,完成单项测试任务平均成本约0.03美元,是全球主流模型中成本最低的。
GPT-5.6Luna
7月10日OpenAI发布,是GPT-5.6系列中速度最快、成本最低的,适用于大规模任务。上线不到三周优化定价和性能,模型价格下调80%。
谷歌Gemini3.6Flash
7月22日发布,输出时消耗token数量比上一代平均减少17%,每百万输入Token价格保持在1.50美元,输出价格由9美元降至7.50美元,降幅约16.7%。

相关问答
上周全球AI大模型总调用量增长情况如何?
上周全球48%,显示出该领域的持续热度和发展态势。
中国大模型周调用量与美国相比如何?
中国大模型周调用量连续十五周超过美国,上周中国达36%。
DeepSeek-V4-Flash正式版有什么突出表现?
它位居上周全球8,3万亿Token,环比增长570%,成本低且Agent能力大幅增强。
GPT-6Luna有哪些特点?
是GPT-6系列中速度最快、成本最低的模型,适用于大规模任务,上线不到三周优化定价,价格下调80%。
谷歌Gemini6Flash有何改进?
输出时消耗token数量比上一代平均减少7%。
上周哪些模型跌出榜单?
此前一周排名第七的MiniMaxM7Flash跌出了上周全球AI大模型调用量榜单。

