8月6日,字节跳动开了一场全员会,梁汝波在会上说了几句意味深长的话。不是产品发布,不是业绩通报,而是一次战略定位的重新梳理。他把豆包和抖音放到了同一个位置——都叫「粗主线」。
豆包=抖音,这不是口号
什么叫「粗主线」?梁汝波在会上解释得很清楚:抖音可以带动电商和生活服务,豆包也可以牵引更多业务和生态。这个表态意味着,豆包不再是字节内部一个「试试看」的项目,而是被正式确立为公司的第二条主干业务线。
这话放在一年前,估计没人信。但现在回头看,字节的AI转型已经走了好几步:飞书团队一分为二,产品团队并入豆包,销售线划归火山引擎。组织架构已经为这场战略升级铺好了路。
更值得关注的是梁汝波的另一个表态。他坦承豆包大模型在AI Coding方面并不算突出,特别拿Anthropic的Claude Code来举例。但他说了一句很硬气的话:「接受短期落后,坚持自研和优化长期。」
张一鸣罕见发声:拒绝蒸馏这条路
同一天,张一鸣在Seed团队全员会上也亮了底牌。他的核心意思一个字:不。不用蒸馏,不走捷径,不接受用别人的模型输出来刷榜单排名。
模型蒸馏本质上是在「复制」大模型的能力。短期见效快——拿别人的大模型当老师,训练自己的小模型,榜单数据能追上。但张一鸣看得很清楚:这条路最多只能逼近对方,永远超不过。而且蒸馏会干扰真正意义上的长期技术突破。
据《The Information》报道,张一鸣一半的工作时间和精力都放在Seed业务上,这在字节的历史上从来没有过。他自己都说,过去几年已经在AI方向投入了很多,未来还会投入更多。
5万亿参数:字节要搞个「巨无霸」
如果说战略表态是定调,那技术动作就是亮剑。据《晚点LatePost》和英国《金融时报》报道,字节正在讨论训练一个参数规模超5万亿——甚至可能达到10万亿——的大语言模型。
这是什么概念?国内目前最大的已发布模型Kimi K3约2.8万亿参数,阿里Qwen3.8-Max约2.4万亿。Anthropic最先进的Mythos 5约8万亿参数。如果字节的新模型跑到10万亿,那将是全球最大规模之一。
主导这个项目的是Seed Foundation负责人项亮,与大语言模型预训练数据负责人沈科合作。据接近Seed的人士透露,团队认为与其在现有尺寸上继续追赶,不如把参数规模一次推到同行的数倍,争取领先位置。
但这个项目还处于早期阶段,预训练预计需要3到6个月,最终发不发布也不一定。
「粗主干」意味着什么
字节这次全员会的信息量很大,但最核心的一条就是「收缩业务宽度,聚焦粗主线」。除了抖音和豆包,梁汝波还提到了TikTok电商在美国进展良好,欧洲略低于预期。
还有一个值得关注的数据:字节内部AI的token调用量半年内增长了十倍以上,已有超过2万名员工使用AI产品,产研人均月报销额度达到140美元。这说明字节不只是对外做AI,内部也在全面AI化。
从张一鸣的「拒绝蒸馏」到梁汝波的「接受短期落后」,再到5万亿参数的巨无霸模型计划——字节在AI上的策略可以总结为八个字:不取巧、下重注、等长期。
这跟OpenAI和Anthropic的策略走的是两条路。大洋彼岸的巨头靠闭源模型建立护城河,字节选择自研+开源+超大规模参数。方向不同,但赌注都不小。谁的路能走通,可能要到2027年才能见分晓。

作为一个刚接触AI的小白,看完只觉得——这些大厂打架再凶,能让我用上的产品才是真的。豆包的App确实越做越好用了,但不知道这个5万亿参数的模型离我们普通人还有多远。
从数据角度看,字节这次战略调整的时机很有意思。正好踩在Anthropic Mythos 5被安全审查、OpenAI Astra被叫停的窗口。外部环境在收紧,字节反而加大投入,反周期操作。
我比较关注的是「粗主线」这个提法。把豆包和抖音并列,说明字节内部已经把AI从成本中心转向利润中心了。而且梁汝波说「不担心经济回报」,这是有底气的。内部token调用量半年涨10倍,先自己用起来再说服外部客户,这个逻辑很顺。
10万亿参数?那训练一次电费得多少啊? 不过比起参数,我更想知道它能不能帮我自动写周报?
不接受蒸馏这条路是对的。短期用别人的模型输出刷榜单,看起来美,但地基是别人打的。等人家下一代模型出来,你蒸馏的那点本事就全废了。字节敢用5万亿参数硬刚,至少方向是对的。只是3到6个月预训练,到时候Mythos 6可能都出来了,窗口期很紧。