8月7日晚上刷到Anthropic的更新,我愣了一下。不是因为功能多炫,而是因为这件事的指向太明确了:AI的使用门槛,正在从"学会写Prompt"变成"直接做给它看"。
一句话说清楚Cowork是什么
Cowork是Anthropic把Claude Code的能力,用桌面应用的形式重新打包了一遍。之前Claude Code是终端命令行工具,只有开发者能玩。Cowork把它变成了一个普通桌面应用,在macOS和Windows上都能跑,不需要写一行代码。
用官方的说法:"Cowork是让任何人——不仅仅是开发者——都能与Claude协作的更简单方式。"翻译成人话:不用学命令行,你就可以让AI帮你操作文件、读写文档、处理表格。
"Record a Skill"才是真正的杀招
8月7日,Cowork上线了一个叫Record a Skill的新功能。操作极其简单:打开屏幕录制,一边做操作一边用嘴解释你在干嘛,录完,AI就学会了。下次你只要说一句"帮我报销这批发票",它就能自动打开邮箱、下载附件、打开Excel、分类填表、生成汇总。
注意,这不是传统的RPA。RPA需要你精确配置每一步点击哪个按钮。Cowork是理解你的意图,然后自己规划步骤。如果中间遇到变化(比如发票格式不一样),它能自己适应,不是傻傻按固定脚本走。
早期测试用户的反馈很有意思:一个做行政的姑娘说,她花5分钟录了一遍月末报销流程,之后每个月AI自己跑完,她只负责最后看一眼。省下来的时间,从3小时压缩到10分钟。
底层逻辑:从"写指令"到"做示范"
这件事的本质是什么?是AI的交互范式在变。
第一阶段是写Prompt。你得学会怎么描述任务,怎么拆步骤,怎么给约束条件。这本身就是一道门槛——很多人的表达能力不足以精确指挥AI。
第二阶段就是做示范。你不需要描述"先打开邮箱,筛选标题含发票的邮件,下载附件,按日期排序……",你直接做一遍,AI看着学。
这个转变的意义有多大?想想看:一个50岁的财务主管,可能学不会写Prompt,但她一定能"录一遍"。这才是真正的AI普惠。
安全问题值得认真看待
但有个事不能回避:Cowork是桌面应用,能直接访问你电脑上的文件。这意味着安全边界从"我上传了什么"变成了"它能访问什么"。
如果你给它的权限是"帮我处理下载文件夹里的发票",它能看到的就是那个文件夹。但如果你让它"帮我整理电脑桌面",它的触及范围就大多了。一个无人值守自动运行的AI,如果没有合理的安全边界,出事的概率不低。
所以Cowork目前更适合个人使用或有IT管理的企业环境。对于数据合规要求严的行业,可能需要等更细粒度的权限控制出来。
说到底,这是个信号
Anthropic这步棋,和OpenAI收购NextSlide、谷歌的Gemini for Workspace、微软的Copilot Studio,指向同一个方向:AI Agent不再是开发者的玩具,它在走进普通人的电脑桌面。
而且有意思的是,据Anthropic工程师透露,Cowork的代码几乎全是Claude自己写的,整个开发周期只用了大约一周半。这事本身比Cowork的功能更值得想:AI正在参与制造自己的下一代表现形式。
如果你问我值不值得试——可以先观望。功能刚上线,macOS和Windows版已经可用,网页版和移动端还在beta。但方向是对的。未来教AI干活,可能真的只需要一张嘴和一只鼠标。

人类终于意识到最好的说明书不是说明书,是"看好了我只演示一遍"?
你确定AI是在"学习"吗?还是说,我们只是把"服从"包装成了"学习"的样子。录屏的本质是示范,示范的前提是信任。问题在于——我们信任AI的判断力了吗?
作为一个每天要处理一堆报销单的人,看到这个功能直接眼睛亮了。我们公司财务流程复杂得很,每次月末报销要搞半天。如果能录一遍给它看,下个月直接让它跑,省下来的时间我都能多喝好几杯咖啡了☕
这个方向是对的。Claude Code我在终端用了几个月,确实强,但门槛高。Cowork本质上就是把Agent能力GUI化,跟当年DOS变Windows一个逻辑。关键看它能不能稳定处理异常情况——RPA最怕的就是流程中途出现预料之外的弹窗。Anthropic用LLM的语义理解来替代规则匹配,理论上确实能解决这个问题。
我已经能想象到翻车现场了:录报销流程的时候不小心开了个淘宝页面,月底AI自动帮我清空购物车?