ITCOW牛新网 8月4日消息,全球 AI 模型 API 集市 OpenRouter 刚晒出 7 月 27 日至 8 月 2 日的周度账单,榜首位置被一款中国模型牢牢占住——DeepSeek-V4-Flash 一周吞下 7.22 万亿 Token,环比再涨 13%,把此前长期盘踞头名的其他选手挤到身后。这家聚合了 400 多款模型、坐拥约 800 万注册用户、月流转百亿级 Token 的平台,又一次用真实生产环境的调用数字证明,海外开发者投票的方向已经明显倾斜。

把视野拉到榜单前半段,景象更夸张:前五名清一色来自中国厂商,小米 MiMo-V2.5 以 6.3 万亿 Token 排第二(环比回落 40%),腾讯 Hy3 收 4.82 万亿排第三(环比涨 22%),DeepSeek-V4-Pro 与智谱 GLM-5.2 分别以 3.28 万亿和 2.89 万亿守住第四、第五。按《每日经济新闻》依据同份周报测算,当周全球大模型总调用约 56.8 万亿 Token,其中国产模型合计 28.13 万亿,美国模型仅 4.38 万亿,中国阵营调用量连续 14 周压过美国总和。即便是 OpenAI 把 GPT-5.6 Luna 输出价砍掉八成、周调用冲到 1.95 万亿挤进第八,也未能撼动前五格局。
据ITCOW牛新网了解,在另一家面向程序员的开源调用入口 OpenCode 上,DeepSeek-V4-Flash 的单日处理量在 8 月 1 日前后冲到 8 万亿 Token,其中 5 万亿走免费试用额度,3 万亿是开发者通过 OpenCode Go 付费套餐实打实刷出来的。OpenCode 团队提到,V4 Flash 正式版上线后平台单日用量和 Go 版新订阅双双涨了约 30%。这种”免费额度引流、付费套餐承接”的曲线,叠加每百万输出 Token 约 2 元、缓存命中输入低至 0.02 元的定价,让它在 Agent 编排、长文档解析和代码生成场景里成了不少海外团队的默认选项,而非单纯拿来跑 demo。
值得拆开看的是,登顶的不只是 DeepSeek 一个名字,而是中国模型整体在”性价比+长上下文+工具调用”组合拳上的兑现。V4 Flash 采用 MoE 架构,总参数量大但单次激活比例低,配合百万级上下文与极高缓存命中折扣,把重复提问的边际成本压到接近零;同榜单里腾讯 Hy3、智谱 GLM-5.2 也各自在中文理解与多模态任务上承接了不同语种开发者的流量。当 OpenRouter 这类中立分发层的真实账单连续一个季度以上偏向同一侧,说明竞争已从”谁的跑分高”切到”谁能让开发者在不破产前提下把模型嵌进生产系统”,而这一刀目前由中国开源权重模型先砍了下去。