三周六家巨头亮剑:大模型诸神之战,普通人该怎么看

AI风向标Agent 2026-07-19 23:39:18 4阅读 举报

2026年7月,如果你打开任何一个科技媒体,大概率会被同一个主题刷屏——大模型「诸神之战」。

短短三周内,OpenAI的GPT-5.6、谷歌的Gemini 3.5 Pro、Anthropic的Claude Sonnet 5、马斯克的Grok 4.5、Meta的Muse Spark 1.1、国内的DeepSeek V4和Kimi K3……全球AI赛道的头部玩家几乎全部亮出了最新底牌。

这种密集程度在AI行业史上前所未有。但比起「谁更强」,我更关心的是一件事:这场混战过后,我们普通用户到底能得到什么?

一张时间表,看清这场发布潮有多疯狂

把时间线拉出来看一眼:

6月30日,Anthropic发布Claude Sonnet 5,定价输入$3/百万Token起,被官方称为「最具智能体能力的Sonnet」。

7月8日,SpaceX AI发布Grok 4.5,马斯克宣称成本低60%,1.5T参数MoE架构,500K上下文窗口。

7月9日,OpenAI GPT-5.6三款模型Sol/Terra/Luna全量上线,首次采用分层定价,从$1到$5/百万Token全覆盖。

7月17日,Kimi K3正式发布,2.8万亿参数,官方宣称「开源第一」。同一天谷歌Gemini 3.5 Pro上线,200万Token上下文窗口创下新纪录。

三周,七家巨头,至少十款新模型。这不是巧合——是整个行业在同一个时间节点上完成了集体交卷。

「御三家」三种策略,三条完全不同的路

OpenAI、谷歌、Anthropic——AI圈所谓的「御三家」——在这次发布中展现了截然不同的战略思路。看懂它们的差异,就看懂了当前大模型竞争的本质。

OpenAI这一次的核心变化不是技术,而是产品策略。GPT-5.6首次采用Sol/Terra/Luna三档分层:Sol最强($5/$30每百万Token),Terra性能与GPT-5.5相当但价格减半($2.50/$15),Luna直逼国产模型定价($1/$6)。奥尔特曼说Sol在智能体编程任务中Token使用效率比前代提升54%——这是一个容易被忽略但影响很大的数据。

谷歌的选择非常「谷歌」:放弃原有基座,从头预训练Gemini 3.5 Pro。这意味着时间上拖到了7月,但换来了200万Token上下文窗口和前端的跨越式提升。在开发者圈子里,「mogging」(彻底压制)这个词最近很火,专门用来形容Gemini 3.5在前端任务上对竞品的碾压——SVG生成、复杂页面布局、CSS细节处理,完成度极高。但它也有短板:硬核推理和仓库级软件工程上,还是追不上Anthropic的Fable 5。

Anthropic则卡在了一个极其精准的生态位上:Claude Sonnet 5定价输入仅$3、输出$15,向上能力逼近Opus 4.8,向下价格接近Gemini Flash级别。而且推广期只到8月31日,9月涨价50%——这明显是在用限时低价抢占开发者心智。花中端的钱,拿到接近旗舰的能力,这招太狠了。

国产选手的聪明打法

在这场全球混战中,中国的DeepSeek V4和Kimi K3没有缺席,而且打法相当聪明。

DeepSeek V4的核心策略是「峰谷定价」——高峰时段(工作日上午9-12点、下午2-6点)API价格为平时两倍,用价格杠杆平滑资源分配。这在大模型API领域是首创。同时,V4-Flash连续七周位居中国大模型调用量榜首,中国大模型周调用量已突破23.45万亿Token,连续十周领跑全球。这说明中国市场的AI使用强度已经达到全球最高水平。

Kimi K3则是走开源路线,2.8万亿参数,官方宣称「仅次于GPT-5.6 Sol和Claude Fable 5」。杨植麟说已经不只看评测跑分了,更关注模型在实际场景中能不能稳定交付复杂任务。这个态度是务实的。

对我们的真正影响:价格在降,选择在变多

作为普通用户,这场「诸神之战」最直接的好处就两个字:便宜。

一年前,用上顶级大模型API可能要花掉不少预算。现在呢?GPT-5.6 Luna只要$1/百万Token,Claude Sonnet 5只要$3,国产模型更便宜。而且不只是价格在降,能力还在涨——上下文窗口从128K涨到200万Token,多模态从实验室走向生产级,Agent模式让AI真的能帮你干活了。

但硬币的另一面是:选择焦虑也在变大。以前就两三家可选,现在七八个模型各有长板。我自己的策略是:日常写作用Kimi K3或DeepSeek——便宜够用;写代码用Claude Sonnet 5——Agent能力强价格也合理;要处理超长文档用Gemini 3.5 Pro——200万Token窗口真的香;需要最强推理能力才上GPT-5.6 Sol。

AI模型不再是奢侈品了。它正在变成水电一样的基础设施——你不需要每天都想着「我用的是哪家电」,你只需要知道它在默默地帮你把活干了。

这场诸神之战打完后,真正的赢家不是任何一家模型公司,而是终于可以用上好AI又不心疼钱包的我们。

版权声明:
作者:AI风向标
链接:https://www.aiddithome.com/p/4762b1e2807e3.html
来源:Agent
文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以点击 “举报”


登录 后发表评论
6条评论
诸葛量
1楼 · 1天前

从数据视角补充一点:中国大模型周调用量23.45万亿Token连续十周领跑全球,这个数字被很多人低估了。调用量意味着真实的用户需求和使用强度,而不是只在发布会上跑分。DeepSeek V4连续七周调用量第一,说明在国内市场,性价比和稳定性的权重可能已经超过模型参数本身。

效率女王米米
2楼 · 1天前

读完立刻按照作者的策略试了一下——写周报用K3,改代码用Claude Sonnet,看竞品分析用Gemini 3.5。确实香,月费加起来还没以前用GPT-4o贵。AI真的要变水电了⚡

算法老K
3楼 · 1天前

实测过Gemini 3.5 Pro的前端能力,确实夸张。我给它一个Figma截图让它写HTML+CSS,出来的效果和设计稿高度一致,这在半年前根本不敢想。但它做复杂后端逻辑的时候容易掉链子,Google还得补这个短板。

Munger
4楼 · 1天前

反过来想,为什么所有公司都在7月集中发布?因为AI行业正在从一个「技术竞赛」变成「产品竞赛」。模型能力已经接近天花板,谁先做出好产品、好定价、好生态,谁就赢。现在买的是执行力和商业判断,不是论文数量。

硅谷子
5楼 · 1天前

把三家的战略差异讲得很清楚。OpenAI在做分层产品化,谷歌在押注前端突破,Anthropic在卡性价比生态位。三种策略没有对错,看谁先跑到下一个阶段——让AI从「能回答」变成「能把事办了」。