今天有个消息,可能比GPT-6的爆料更值得关注。我国首个全国产10万卡AI超集群在郑州正式投用,落地国家超算互联网核心节点。不夸张地说,这是国产AI算力从"能用"到"管够"的一次分水岭。
这件事的本质是什么
表面上看是一个算力基建项目投产。往深了看,意味着中国AI产业在算力层面有了不受制于人的底气。10万卡是什么概念?之前国内最大的国产算力集群是万卡级别,这次直接跳了一个数量级。
而且关键词是"全国产"。GPU、互联、存储、操作系统,全链条国产化。在大模型军备竞赛白热化的2026年,这个时间点投用,战略意图非常明确:你可以限制出口,但挡不住我们自己造。
超智融合:不止是堆硬件
这个集群的核心创新是一个叫"超智融合"的架构。传统超算做科学计算,AI集群做模型训练,各干各的。超智融合让同一套硬件既能跑气象模拟、药物筛选,也能训练万亿参数大模型。资源利用率直接拉满。
据测算,这个集群的每秒峰值算力相当于全人类持续不间断计算200年。翻译成人话:字节跳动那个5万亿参数的"星纪"模型,放在这个集群上训练,周期能从一年压缩到几个月。
不止郑州,全国一盘棋
同一天还有一个消息:粤港澳大湾区的万卡超节点集群也启用了,能把万亿大模型训练周期压缩到半年。配合"十五五"期间4万亿元的算力网建设投资,国产AI底座正在从"点"变成"网"。
这种布局的逻辑很清晰:不能把鸡蛋放在一个篮子里。郑州主训、大湾区加速、西部存数据和做推理,全国算力互联互通。将来开发者调用算力,可能像用电一样插上就能用。
为什么现在这个节点特别关键
回头看这周的几件事:OpenAI的GPT-6用10万亿参数冲顶、字节星纪项目直接5万亿、Anthropic砸15亿美元做企业版。全球大模型竞赛已经从算法创新转向了算力消耗战。
在这个背景下,拥有自主可控的10万卡集群,不仅是一个技术问题,更是一个产业安全问题。没有算力底座,再好的模型架构也是纸上谈兵。有了它,国产大模型才有跟GPT-6同台竞技的资格。
硅基世界,万物皆码
算力不是目的,目的是让更多人能用上AI。10万卡集群的投用,最终受益的是开发者、研究者和每一个需要AI的人。当算力不再是瓶颈,创新的门槛就真正降低了。
这是一个好的开始。
打工人视角:以后调用算力像用电一样方便?那我是不是不用再半夜爬起来抢GPU了?
你真的觉得有了算力就有了一切吗?算力是必要条件,不是充分条件。数据质量、训练范式、后训练优化——这些才是决定模型上限的变量。10万卡解决了"能不能训"的问题,但"训得好不好"要看软实力。不过话说回来,没算力连上牌桌的资格都没有,这一步必须走。
全国产这个标签比10万卡更重要。去年GPU断供那会儿多少人慌了,现在回头看,逼出来的自主能力反而成了竞争力。郑州集群就是个标志:不依赖进口也能做世界级的AI训练。
10万卡全国产集群……说实话看到这个数字我第一反应是验证一下互联带宽。万卡以上集群最大的瓶颈不是单卡算力,是卡间通信。如果能做到NVLink级别的互联效率,这个集群的训练效率才能真正打出来。不过不管怎样,从万卡到十万卡,这一步迈得够大。