7月19日,商汤在WAIC 2026发布了SenseNova U1 Pro。看完全场演示,我觉得这款产品踩到了一个行业痛点——“抽卡”。
如果你用过AI生图,一定懂这个词。同一个Prompt跑五次,五次结果都不一样。有时候质量天差地别,全靠运气。商汤U1 Pro说自己能解决这个问题,而且不只是生图层面的,是整个智能体“交付”层面的。
交付级,到底什么意思
商汤给U1 Pro的定位是“交付级原生多模态智能体基座”。拆开来看有两层意思。
第一层是“原生多模态”,不是文字转图像那种拼接式多模态,而是理解、生成、行动三个能力在一个架构里统一训练出来的。这意味着模型在生成图像时“理解”这张图的上下文,而不是机械地执行指令。
第二层是“交付级”。这是全文最关键的概念。商汤的意思很直白:AI生成的东西要达到可以直接交付给客户的标准,不需要人工再改一次。听起来像基本要求,但在AI创作领域,这其实是个挺高的门槛。
演示了什么
现场有两个演示让我印象比较深。
一个是4:1超宽画幅的宣纸水墨风东方美学长卷,从2018到2026九年WAIC发展历程。远看是一幅完整的视觉叙事,放大后文字、图标等设计细节都清晰。这要求AI既要理解“九年时间线”这个抽象概念,又要精准控制每个元素的位置——两种能力很少在同一个模型里同时出现。
另一个是视频故事板。U1 Pro自主规划了剧情世界观、人设、服装、色调,然后一次性输出22个逻辑一致的连续分镜。做过视频创作的人都知道,连续分镜的一致性是目前AI最薄弱的环节之一,人物换个角度就变脸这种事太常见了。
最高支持8K原生分辨率输出,开源版本GitHub两个月8000星——说明开发者圈子里认可度不低。
对行业意味着什么
36氪的评论很到位:U1 Pro标志着多模态AI从“能生成”的演示阶段进入“可交付”的实用阶段。
这和WAIC今年整体基调是一致的。逛完几个大厂展台你会发现,大家不怎么谈参数量了,都在说“交付了什么”。阿里秒悟讲企业协同交付,腾讯智能体展区讲“从聊天到干活”,京东JoyAI讲物理世界交付。
这是一种成熟的表现。回想2024年大家还在卷参数和排行榜,现在卷的是“你帮我省了多少人工”。对用户来说,这才是真正的进步。
但别被“交付级”忽悠了
客观说一句。商汤展示的案例都是精心挑选的标杆场景。从“能交付”到“稳定交付”之间还有很长的工程化距离。企业级用户关心的不是一次演示效果,是100次、1000次调用中失败的次数。
另外,U1 Pro定位“智能体基座”,这意味着它的价值很大程度上取决于生态伙伴在上面能造出什么应用。基座再强,上面没有好应用,用户也感知不到。
但这不妨碍它代表了一个正确方向。AI行业走到2026年下半年,该过“能生成”的新鲜劲儿了,是时候问问自己:生成的东西,到底有多少能直接交付?

那个22个连续分镜的演示太牛了,做短剧的应该很喜欢
8000星说明技术没问题,问题是商汤的商业化能力能不能跟上
“交付级”这个概念好,但得看实际落地。很多AI公司PPT做的比产品好
我就在用AI生图做电商主图,一天跑几百张,真能稳定交付的话我愿意付费
商汤这几年感觉憋着大招,U1 Pro演示确实比之前强不少