今天看到一组数据,忍不住想聊聊。
OpenRouter刚发布了上周(8月3日至8月9日)的全球AI大模型调用量榜单,DeepSeek-V4-Flash正式版以8.83万亿Token的周调用量直接登顶全球第一,环比增长570%。更夸张的是,全球调用量前四名全是国产模型。
这个数字什么概念?上周全球AI大模型总调用量是69万亿Token,中国模型合计34.25万亿,占了一半还多。而且这已经是连续第15周超过美国了。
为什么是Flash?
很多人可能还停留在"参数越多越强"的认知里。但V4-Flash告诉市场一件事:开发者用脚投票选的不是最贵的,而是性价比最高的。
Artificial Analysis测算过,V4-Flash正式版完成单项测试任务的平均成本约0.03美元,只有Anthropic旗舰模型Claude Fable 5的百分之一。输入0.14美元/百万Token,输出0.28美元/百万Token。这个价格,基本上把"用AI不划算"这条路给堵死了。
7月31日上线API公测后,单日使用量涨了30%,新订阅用户也涨了30%。OpenRouter平台数据显示,美欧开发者占比接近一半。大量海外开发者正在把生产环境的推理流量往DeepSeek迁移。
中国开源模型的全球突围
一个更有意思的信号:据人民日报8月10日报道,美国硅谷近200家科技初创企业联名致信政府,明确反对限制本土企业使用中国开放权重模型。信里说得很直白:"美国开发者需要持续使用全球现有的开放模型"。
为什么反对?因为第三方监测显示,美国企业调用中国模型的Token占比每周稳定在30%以上,峰值达46%。中小科技公司付不起闭源模型的高昂费用,也没法从零训练,中国开源模型已经成了它们的创新底座。
开放权重还允许本地部署、自主调整安全策略,在应急处置等场景反而比闭源模型更灵活。这个逻辑很清晰:技术可以被限制,但性价比和市场选择很难被行政命令逆转。
对行业意味着什么?
过去两年,AI行业的叙事一直是"OpenAI领跑,中国追赶"。但调用量数据正在讲一个不同的故事。
全球开发者每天在生产环境里真金白银地调用模型,他们不关心参数竞赛,只关心两件事:能不能干活,成本划不划算。DeepSeek-V4-Flash在这两个维度上同时拿到了高分,所以调用量暴涨570%。
OpenAI已经跟进调价了。GPT-5.6 Luna模型价格下调80%,进入全球前五,周调用量4.43万亿Token。这说明什么?价格战已经开打,而且是被中国模型逼着打的。
当然,调用量不等于一切。在前沿能力上,OpenAI、Anthropic的旗舰模型仍然有优势。但如果看"谁在用、用多少",中国开源模型正在从"备选"变成"默认选项"。这个趋势一旦形成,很难逆转。
2026年,AI行业的竞争逻辑正在从"谁的模型最聪明"切换到"谁的生态最实用、成本最低"。这场仗,中国模型暂时领先一个身位。

所以以后做AI产品,先用Flash跑通MVP,需要前沿能力再上Pro,这个思路越来越成熟了
成本是原来的百分之一,这价格战打得够狠 ?
200家硅谷初创联名反对限制中国模型,这个细节才是重点。技术可以被限制,但市场选择很难逆转。当你的生产环境已经跑在中国模型上,换回去的成本比继续用高得多。
从数据看,中国模型连续15周调用量超过美国,这已经不是偶然波动了。但有个细节值得注意:前四名虽然都是国产模型,但OpenAI的GPT-5.6 Luna也进了前五(4.43万亿Token),说明美国模型在降价后也在追赶。价格战已经开打,对开发者来说是好事。
调用量这个指标确实比参数更能说明问题。开发者用脚投票,选的是能干活+成本低的,不是最贵的。570%的环比增长,说明V4-Flash正式版解决了一个很实际的痛点:Agent场景下的推理成本太高了。0.03美元/任务的平均成本,基本上把"用AI不划算"这条路堵死了。