DeepSeek Harness正式亮相:大模型公司为什么开始自己做Agent操作系统

AI风向标Agent 2026-08-11 22:54:52 7阅读 举报

8月11日,一个不太起眼的细节在AI圈传开了:一个叫"DeepSeek Harness(工具框架)"的微信公众号完成了注册,认证主体是北京深度求索人工智能基础技术研究有限公司。

看起来只是注册了个公众号,但仔细一琢磨,这事不简单。这是DeepSeek第一次为某条业务线单独开设官方账号,而且独立于主号运营。能让一家以"模型为王"著称的公司专门辟出一个阵地来吆喝的,绝对不是小动作。

Harness到底是什么

说白了,Harness就是"把大模型变成能干活的智能体"的那层东西。

大模型本身很强,能理解需求、做推理、生成方案。但让它真正去执行一个复杂任务——比如帮你写完一个项目代码、自动处理一批邮件、或者协调多个工具完成一个工作流——它光靠自己是不够的。Harness干的就是模型之外的事:调度上下文、管理工具调用、追踪任务状态、处理错误恢复。

打个比方,模型是大脑,Harness就是神经系统,负责把大脑的指令传达到手脚,再把反馈收回来。

这个概念不新。2025年卡帕西提出VibeCoding之后,OpenAI的Codex和Anthropic的Claude Code就是最早跑通的两款Harness产品。它们直接让这两家公司的模型和其他产品拉开了代差。

DeepSeek为什么这时候入局

根据公开信息,DeepSeek Harness在2026年5月内部立项,独立组建团队,负责人是崔添翼——浙大计算机系出身,在量化交易公司Jane Street干了九年,2026年3月刚加入DeepSeek。8月2日,他已经面向全球公开征集Harness内测用户,优先筛选有Agent Harness开源项目经验的开发者,短时间就吸引了数十名全球开发者报名。

从团队架构看,DeepSeek把模型团队和Harness团队做了切割,Harness团队还明确要组建"多个模型接口方向"的工程师。这两件事放在一起看,意思很明确:Harness要独立运作,而且大概率不只服务自家模型。

这和Claude Code的封闭路线形成了鲜明对比。Claude Code只允许接入Anthropic官方模型,甚至在今年6月被曝出存在安全后门——用户指向非官方端点时,客户端会通过修改系统提示词里的日期字符串,把代理域名、系统时区等信息隐写回传给Anthropic服务器。工信部随后发布了风险提示,阿里、腾讯、美团、京东纷纷要求团队排查并转向自研工具。

智能体代码赛道的真实体量

这个赛道到底有多大?东方证券5月的研报给了个数字:2026年全球智能体代码市场约80亿美元,前四名占了86%的份额,远期中美潜在市场合计4000亿美元。但这个数字可能很快就过时了。

Anthropic今年2月融资后透露,Claude Code的年化收入已经到25亿美元,占其整体年化收入140亿美元的18%。到7月底,海外分析机构TickerTrends认为Anthropic的整体年化收入已经到了741亿美元。换句话说,Harness类产品已经不是概念验证阶段了,而是真金白银在赚钱。

中信证券的分析说得很直白:Harness的核心价值是解决长程任务的痛点,把模型能力转化为稳定、低成本的端到端交付,同时连接泛办公场景,拓展万亿级市场。

这件事意味着什么

海通国际8月5日的研报点出了一个关键判断:模型竞争正在从参数规模转向后训练和系统工程。未来模型的实际效果,越来越取决于"模型+Harness+工具+数据"的整体组合,而不是单纯的基础模型能力。

DeepSeek入局Harness,某种程度上是在承认一个现实:光有好模型不够,你还得有好框架让模型真正落地。这和当年安卓之于智能手机的逻辑类似——操作系统才是生态的入口。

如果DeepSeek Harness真的走开放路线,能接入多家模型,那它有机会成为中国开发者在Claude Code受限之后的一个替代选择。尤其是V4-Flash正式版的Agent能力已经接近头部模型,搭配自研Harness,性价比优势会更明显。

2026年下半年,AI编程工具的格局可能要重新洗了。OpenAI的Codex、Anthropic的Claude Code、DeepSeek的Harness,三足鼎立的雏形已经出来了。至于谁能跑出来,就看谁的生态做得更开放、更扎实。

版权声明:
作者:AI风向标
链接:https://www.aiddithome.com/p/67fa025530533.html
来源:Agent
文章版权归作者所有,未经允许请勿转载,若此文章存在违规行为,您可以点击 “举报”


登录 后发表评论
5条评论
孙悟空
1楼 · 19小时前

大脑和神经系统的比喻很到位? 光有大脑没有神经系统,那不就成了植物人了嘛哈哈

熵熵
2楼 · 19小时前

三足鼎立?我更想看四国大战。字节10万亿参数的模型+Trae,这局还没完呢?

阿段.skill
3楼 · 19小时前

做开发的朋友应该关注一下V4-Flash+Harness这个组合。13B激活参数、100万token上下文,如果Agent能力真的接近Claude Code,那性价比简直是降维打击。

硅谷子
4楼 · 19小时前

这个判断我很认同。模型竞争从参数规模转向系统工程,是2026年最重要的行业拐点之一。DeepSeek把Harness团队和模型团队切割,说明它想的不只是做一个附属品,而是要做一个独立的产品层。这和安卓早期独立于手机硬件的逻辑是一样的。?

乔帮主
5楼 · 19小时前

Claude Code安全后门那事确实让很多企业心凉了。阿里腾讯美团京东集体排查转向自研,说明国产替代的需求是真实的,不是口号。DeepSeek如果真走开放路线,时机恰好。