Gemini 3.7 Flash三周迭代价格腰斩:Agent模型性价比之战开打

工具猎人AI学习 2026-08-14 20:26:36 5阅读 举报

8月13日,Google DeepMind发布了Gemini 3.7 Flash。距离上一版3.6 Flash发布才过了三周。更夸张的是价格:输入0.75美元/百万token,输出3.75美元/百万token,正好是3.6 Flash的一半。

三周一个版本,价格砍一半。这个节奏已经不是在卷模型能力了,而是在卷一个更接地气的东西:性价比。

Flash系列的定位变了

以前Google的模型分层很清晰:Pro是旗舰,做最难的活;Flash是轻量版,给预算有限的用户用。但3.7 Flash的定位明显在变。DeepMind官方直接管它叫"最强工作模型",意思是日常编码和Agent任务不用上Pro,Flash就能搞定主力。

这个变化很有意思。它反映的是一个行业趋势:Agent场景对模型的需求不是"最聪明",而是"够聪明且够便宜"。一个Agent系统跑一个任务可能要调几十次API,每次调用都要付费。如果用最贵的旗舰模型,一个复杂任务跑下来成本可能几十美元。但用Flash级别的模型,成本能压到几十分之一,而效果差距可能只有几个百分点。

实测表现如何

从已经跑过的基准测试来看,3.7 Flash在编码和Agent任务上比3.6有明显提升。在FrontierCode和DeepSWE两个编码基准上分数都有增长,具体数字各家报法不同,但方向是确定的:编码能力在持续进步。

同一天,DeepSeek也放出了V4 Pro正式版,输入3元/百万token、输出6元/百万token,Agent评测在Terminal Bench拿了87.9分,CyberGym和AutomationBench都超过了GPT-5.5。两家几乎同时出手,价格都在往下打。

对开发者来说,这是一个非常好的信号。半年前跑一个中等复杂度的Agent任务,模型调用成本可能要几美元。现在同样复杂度的任务,用Flash级别的模型只要几毛钱。成本下降的速度比模型能力提升的速度还快。

对Agent开发者的实际意义

如果你在做Agent系统,3.7 Flash的发布意味着几件事。

第一,分层调用策略变得更有价值。简单的信息提取、格式化、路由分发这类任务,用Flash绰绰有余;只有真正需要深度推理的环节才需要切到Pro或旗舰模型。这种分层用法能把整体成本压到原来的三分之一甚至更低。

第二,长时间运行的Agent任务变得更可行。以前跑一个需要几百次API调用的长任务,成本可能是个问题。现在Flash价格腰斩,同样的预算可以跑多三四倍的任务量。这对需要持续监控、迭代优化的Agent场景特别友好。

第三,GitHub Copilot已经第一时间接入了3.7 Flash。如果你在用Copilot,可能会发现代码补全和建议的速度、质量都有提升,而且不会影响你的订阅费用。这个算是直接的用户体验升级。

价格战的下一步

三周迭代一次、价格砍一半,Google这个节奏明显是在抢市场。目前Agent模型的竞争格局是:OpenAI的GPT-5.6系列、Anthropic的Claude 4.x系列、Google的Gemini 3.x系列、还有DeepSeek这个价格屠夫。

从价格趋势来看,Flash级别的模型正在成为Agent任务的主力选择。各家都在用降价来抢开发者的心智。对终端用户来说,这是好事——未来半年,Agent应用的运营成本还会继续下降。

总结

Gemini 3.7 Flash不是一次模型能力的飞跃,但它是Agent模型性价比之战的一个重要节点。当"够用且便宜"成为主流需求,模型厂商的竞争维度就从跑分转向了成本控制。这场仗打下来,受益的是所有做Agent应用的开发者和用户。

版权声明:
作者:工具猎人
链接:https://www.aiddithome.com/p/c0ced3ed2ece.html
来源:AI学习
文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以点击 “举报”


登录 后发表评论
5条评论
林黛玉
1楼 · 4小时前

Copilot第一时间接入3.7 Flash这个细节值得注意。说明Google内部对Flash的信心很足,不怕在Copilot这种核心产品上直接替换。

弱弱.skill
2楼 · 4小时前

DeepSeek同天发V4 Pro转正也是这个逻辑。输入3元输出6元,Agent评测分数还很高。价格战已经开始了,受益的是我们这些小开发者?

诸葛量
3楼 · 4小时前

从数据看,Flash系列的能力天花板在快速逼近Pro系列。按照这个迭代速度,可能明年Flash就能覆盖现在Pro 80%以上的场景。到那时候Pro的定位会变得更尴尬。

AI摸鱼大王
4楼 · 4小时前

三周一个版本,价格砍一半。Google这是在用做消费品的节奏做模型啊。不过对开发者来说确实爽,半年前跑一个Agent任务要几美元,现在几毛钱。

Prompt工程师小林
5楼 · 4小时前

分层调用这个思路确实实用。我最近在做的项目里,信息提取和格式化全部走Flash,只有最后一步需要深度推理才切Pro。整体成本降了大概60%,效果几乎没损失。3.7 Flash出来后这个策略就更香了。