OpenAI抢购数万台Mac mini:Agent强化学习为何抛弃英伟达

AI风向标Agent 2026-08-31 16:24:57 5阅读 举报

一条很有意思的消息:OpenAI正在疯狂采购苹果Mac mini,而且数量是"数万台"级别。The Information披露,这笔订单到现在还在追加中。与此同时,Anthropic也没闲着,只是策略不同,他们选择从AWS租用Mac算力,单台每小时租金超过1美元。

为什么是Mac mini,不是英伟达GPU?

首先要搞清楚一个关键前提:这批Mac不是拿来做大模型预训练的。预训练那个活儿,英伟达GPU在性价比上仍然碾压一切。但这批Mac的使命完全不同,它们服务于一个正在成为行业焦点的新环节:Agent强化学习训练。

传统的大模型预训练,本质上是在海量文本上做"填空题",计算模式高度并行,GPU天生擅长这个。但Agent训练是另一回事。Agent需要在真实或模拟环境中执行一系列动作,拿到反馈,再调整策略。这个过程更像是让一个人反复练习走迷宫,而不是一次背完整本攻略。

这种训练模式的计算特征完全不同:它需要大量的环境并发实例,每个实例的计算量不大,但对CPU调度能力、内存容量和I/O吞吐的要求非常高。Mac mini搭载的Apple Silicon芯片恰好在这几个维度上表现突出,尤其是统一内存架构,让CPU和GPU共享同一块内存池,数据搬运的开销大幅降低。

算力经济学:不只是性能,更是成本

一台M4 Max版本的Mac mini售价大约3500美元。而一台配备8张H100的DGX服务器,价格超过12万美元。如果是做Agent的环境模拟和强化学习,你需要的不是单卡的极致算力,而是成百上千个并发环境的稳定运行能力。在这个场景下,Mac mini的性价比确实有吸引力。

更关键的是能耗。数据中心的电费正在成为AI训练最大的隐性成本之一。一台Mac mini的功耗在15到65瓦之间,而一张H100的TDP就是700瓦。同样规模的计算任务,用Mac集群和用GPU集群的电费差距可能是一个数量级。

当然,苹果这边也不是没有瓶颈。macOS在大规模集群管理上的生态远不如Linux成熟,而且苹果的芯片供应本身也有产能上限。有报道称OpenAI和Anthropic的抢购已经导致Mac mini在某些渠道出现缺货。华硕、微星等品牌的RTX消费级显卡首批发完还在求货,AI对算力的饥渴已经蔓延到了以前完全想不到的硬件品类。

Agent训练:一个全新的算力赛道

这件事的深层意义在于:AI行业正在从"训练大模型"这一个核心环节,分化为多个计算特征完全不同的子环节。预训练是一个,推理部署是一个,Agent强化学习正在成为第三个。

每个子环节对硬件的需求都不一样。预训练要GPU集群的暴力并行,推理要低延迟和高吞吐的平衡,而Agent训练要的是大规模并发环境和灵活的环境重置能力。这意味着未来AI公司的算力采购策略会越来越复杂,不再是"买一堆H100就完事"。

OpenAI用脚投票选择了Mac mini,Anthropic选择了云租赁,路线不同,但方向一致:Agent时代需要的算力基础设施,跟大模型时代完全不是一回事。这个转变才刚刚开始。

版权声明:
作者:AI风向标
链接:https://www.aiddithome.com/p/3a2aedace0a6f.html
来源:Agent
文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以点击 “举报”


登录 后发表评论
5条评论
AI搞钱研究所
1楼 · 19小时前

看到'数万台Mac mini'这个量级,说实话第一反应是:苹果的供应链部门现在估计在开香槟。不过认真讲,这个趋势对中小团队其实是个好消息。Mac mini单价3500美元,十台就是3.5万美元,跑一个中等规模的Agent训练集群,门槛比买GPU集群低太多了。

熵熵
2楼 · 19小时前

所以未来AI训练的瓶颈不是算力,而是苹果产能?? 这剧情也太魔幻了吧

代码杰哥
3楼 · 19小时前

从工程角度补充一点:Mac mini的功耗确实香。15到65瓦跑一个Agent环境实例,跟H100的700瓦TDP比,差了快一个数量级。数据中心电费现在占训练成本的比重越来越高,这笔账不能不算。

硅谷子
4楼 · 19小时前

算力这件事,正在从'谁有最多的GPU'变成'谁有最合适的算力组合'。预训练要GPU,推理要平衡,Agent训练要并发。每个环节的最优解都不一样。OpenAI买Mac mini、自研Jalapeño芯片、用英伟达做预训练,三条线并行,说明他们内部已经很清楚不同环节需要什么了。未来的AI公司,算力采购策略可能比模型架构更重要。

算法老K
5楼 · 19小时前

这个角度确实没想到。以前大家讨论AI算力,眼里只有英伟达。但Agent训练跟预训练的计算特征确实不一样,一个是暴力并行,一个是大规模并发环境模拟。Mac mini的统一内存架构在这个场景下确实有天然优势。不过有个隐患:macOS的集群管理生态太弱了,Kubernetes对macOS的支持几乎为零,OpenAI估计得自己造轮子。