DeepSeek V4 Flash以7.22万亿调用量全球周榜首日
OpenRouter公布的全球AI大模型调用量周榜单显示,DeepSeek V4 Flash在7月27日至8月2日期间处理7.22万亿Token,成为调用量最高的模型。
OpenCode平台披露模型使用情况
开源项目OpenCode发布的数据指出,DeepSeek V4 Flash在8月1日单日处理8万亿Token。其中5万亿来自免费试用额度,3万亿通过该平台付费调用。
该模型自今年4月发布后,始终主打平衡推理速度、长上下文处理能力与调用成本的定位。
全球调用量数据对比分析
根据OpenRouter统计,上周全球AI大模型总调用量达56.8万亿Token,环比下降2.07%。
- 中国AI大模型周调用量为28.13万亿Token,环比减少14.76%
- 美国AI大模型调用量4.38万亿Token,环比增长87.18%
- 中国大模型连续十四周保持周调用量全球领先
界面新闻于8月5日查询该榜单发现,DeepSeek V4 Flash 0423版本仍在调用量榜首位,累计处理量达6.92万亿Token。
DeepSeek V4 Flash在开发者群体中保持高度活跃,其商业化应用范围已覆盖多个行业领域。
OpenRouter本周调用量榜单(截至发稿) 排在第二位的是小米推出的MiMo-V2.5,周调用量5.1万亿Token,环比前一周下滑52%,流量出现明显回调,市场热度有所回落。 小米这款模型于今年4月23日正式公测,4月底完成全系列开源。其采用混合专家MoE架构,总参数突破万亿级别,激活参数42B,标配100万Token超长上下文窗口,同时覆盖文本、语音、图像全模态交互。低廉推理成本与稳定智能体运行能力,是其吸引海外开发者批量接入的核心优势。 就在7月20日至7月26日当周,MiMo-V2.5曾登顶OpenRouter周调用量榜单首位,单周调用量达到10.5万亿Token,环比增长12%。 目前第三名来自腾讯自研大模型混元Hy3,调用规模5.01万亿Token。Hy3是腾讯自研通用大模型,该模型本期流量环比持平,增长幅度为0%。Hy3曾是7月26日所在周榜单增长势头最猛的模型,彼时周调用量3.94万亿Tokens,环比增幅超999%。 Hy3于7月6日正式开源,总参数295B、单次推理仅激活21B参数。其采用快慢思考融合架构,最大支持256K上下文,代码生成、智能交互能力大幅迭代。腾讯混元曾发文表示,截至7月15日,Hy3总调用量较上一代模型Hy2增长已超68倍。 第四名同样来自DeepSeek的V4 Flash 0731模型。这是DeepSeek全新上线的新版本模型,周流量3.45万亿Token。第五名则是OpenAI推出的GPT-5.6 Luna,本周Token调用量2.99万亿,实现738%的爆发式增长。 榜单前五席位之中,国产大模型包揽前四位,展现出极强的市场调用热度。但OpenAI全新迭代模型强势追赶,意味着全球头部厂商之间的竞争并未放缓。 从前十来看,DeepSeek占据三个席位,除两款V4 Flash版本外,DeepSeek V4 Pro以2.97万亿Token排在第六位。Anthropic、谷歌、NVIDIA、MiniMax、阶跃星辰、智谱AI等多家企业模型纷纷上榜。免费模型正在占据越来越多流量份额,NVIDIA Nemotron 3 Ultra、Poolside Laguna S 2.1、Inclusion AI Ling-3.0-flash等免费模型实现高速增长,不少免费模型环比涨幅突破50%。 值得一提的是,此前备受马斯克关注的Kimi K3模型在本周暂时跌出了前十,目前位列第12位。该模型总参数达2.8万亿,配备100万Token超长上下文窗口,为当前全球参数规模最大开源大模型。 不同于过去依靠低价换取流量的竞争模式,当前国产模型依靠持续迭代的推理性能、稳定服务能力吸引海外开发者。但挑战同样存在,OpenAI、Anthropic持续推出新版本模型,不断缩小性能差距;谷歌Gemini系列多款模型稳定盘踞榜单前列,海外巨头依旧拥有稳固基本盘。 赛道内部的分化同样值得警惕。部分国产模型本期出现调用量大幅下滑,小米MiMo-V2.5、MiniMax M3、智谱GLM5.2均出现不同程度流量回落。由于热度轮换速度不断加快,一旦产品迭代节奏放缓,很容易快速流失开发者流量。 有人工智能行业分析师指出,海外独立开发者市场已经进入白热化竞争,仅仅依靠单次版本更新很难守住优势。如何持续迭代、高效控制推理成本,将决定各大模型能否长期留住用户。(文章来源:界面新闻)
