8月13日,谷歌发布了Gemini 3.7 Flash。跟模型性能提升相比,更让开发者圈子兴奋的是一项限时促销:到2026年底之前,输入价格0.75美元/百万token,输出3.75美元/百万token,只有标准价格的一半。
2027年1月1日起恢复原价,输入1.5美元、输出7.5美元。说白了,谷歌发了一张有效期四个多月的"五折体验券"。
我试了一周,说说我的看法。
价格对比:现在谁最便宜
把目前主流模型的价格拉出来横向比一下。Gemini 3.7 Flash打折后的输入价0.75美元,在同级别模型里确实有竞争力。DeepSeek V4 Pro刚刚涨了价,高峰时段输入价格最高到了每百万token的12倍(缓存命中场景),折算下来并不便宜。Claude Sonnet系列的价格在中间档,Anthropic最近还专门发了Claude Code省钱指南,可见用户对成本有多敏感。
OpenAI这边,GPT系列的价格一直在中高档。ChatGPT的企业版订阅更贵。谷歌这一波五折,直接把Flash系列推到了"性价比之王"的位置,至少在这四个多月里是这样。
性能怎么样:不只是便宜
光便宜没用,关键还得能干活。我这一周主要测试了几个场景:日常对话、代码辅助、文档摘要、长上下文处理。
日常对话这块没什么好说的,Flash系列一直够快,响应速度比Pro系列快了不少,适合对延迟敏感的应用场景。代码辅助方面,简单任务没问题,复杂的多文件重构还是得用更高级的模型。文档摘要是Flash的强项,3.7版本在多语言处理上比上一代有明显进步。
最让我意外的是长上下文处理。Gemini的上下文窗口一直是行业领先的,3.7 Flash继承了这个优势。在处理几万字的长文档时,它的信息提取准确率比同价位的竞品高出不少。这对做RAG应用、知识库问答的开发者来说,是个实实在在的加分项。
谷歌的战略意图:用低价换入口
谷歌这步棋不难看懂。用低价降低开发者试用和迁移的成本,让Flash成为AI Agent时代的默认工作模型。一旦开发者的工具链围绕Flash搭建起来,2027年恢复原价后,很多人可能已经不愿意再换回去了。
这和当年安卓的逻辑一样:先把操作系统免费送出去,再通过应用生态赚钱。谷歌赌的是,当开发者习惯了Gemini的速度、上下文窗口和价格之后,它会成为Agent基础设施的一部分。
但有一个变数:Agent场景对模型的可靠性要求极高。一个模型可以很快且成本很低,但如果它在长时间任务中会偏离轨道或者做出错误决策,那成本再低也没用。这也是为什么很多开发者对Flash系列的态度是"试试看"而不是"直接切换"。
对中小开发者的实际建议
如果你在做AI应用,现在确实是试用Gemini 3.7 Flash的好时机。五折的价格意味着试错成本很低。特别是这几个场景值得关注:需要处理大量文本的RAG应用、对响应速度有要求的实时交互场景、以及需要长上下文的文档分析工具。
但不建议直接all-in。原因很简单:四个多月后价格翻倍,你得确保届时的成本模型还能撑得住。更好的策略是把Flash作为备选方案之一,在工具链里做好模型切换的抽象层,根据任务复杂度动态选择不同档位的模型。
另外,谷歌这次降价也释放了一个信号:AI模型的价格战才刚刚开始。DeepSeek刚涨完价,谷歌就打折。这种此消彼长的定价策略,对开发者来说其实是好事。多模型对比、按需选择,才是2026年做AI应用的正确姿势。
做Agent的都知道,长时间任务中模型跑偏才是真正痛点。便宜是便宜,但可靠性没经过大规模验证之前,我倾向于先把Flash当备选用。工具链里做好模型抽象层这个建议很实在。
五折体验券这个说法太精准了。跟健身房办卡一个套路,先让你便宜进来,等你习惯了再来涨价?
刚试了一下Gemini 3.7 Flash处理长文档,速度确实快。但有个问题:它在中文长文本的信息提取上偶尔会漏掉关键细节,不知道是不是版本问题。
DeepSeek刚涨价,谷歌就打折,这个时间差很有意思。AI模型的价格战才刚开始,后面还会更卷。
作为做AI办公应用的人,最关心的就是成本模型。五折期间试了一下,处理一份50页的合同摘要只要几分钱,这个价格确实香。但2027年翻倍之后就得重新算了。