← All posts

同一只龙虾🦞,两种养法

过去三周发生的事情,比ChatGPT刚出来的时候更重要。东西方在养龙虾的方式也出现了两极化☯️

这不是夸张。ChatGPT在2022年底引发的是一场认知冲击:原来AI可以这样对话。但对话归对话,它改变的是人和信息的关系,没有改变人和工具的关系。你还是得自己开Excel,自己写邮件,自己订机票。

2026年3月,这件事变了。

AI agent不再是概念,不再是demo,不再是某个创业公司pitch deck里的第三页。它在三周之内,变成了中国每一家科技巨头的核心产品线,变成了Nvidia CEO在GTC主题演讲里反复强调的关键词,变成了地方政府的补贴对象,变成了安全研究员的噩梦,也变成了普通人第一次真正可以"让AI帮自己干活"的东西。

这篇文章不是来给你解释什么是AI agent的。如果你过去一个月有上网,你已经知道了。

这篇文章要说的是:过去三周释放的信号意味着什么,以及为什么中国和美国对同一个信号做出了完全相反的反应。


动员所有人

先说一个背景。

2月14日,OpenAI的Sam Altman在X上宣布,OpenClaw的创始人Peter Steinberger加入OpenAI,负责"下一代个人agent"的开发。OpenClaw项目转交给一个独立的开源基金会,OpenAI持续赞助。

但这件事的信号意义远大于一个人事变动:OpenAI不再只押对话,它要押行动。ChatGPT是一个聊天窗口,但OpenAI的下一步是让AI真正替你干活。

然后,事情的密度开始变得不正常。

不只是中国。Anthropic在1月发布了Claude Cowork,一个住在你电脑上的桌面端agent,能操控文件、浏览器和本地软件。3月18日又推出了Dispatch,让你用手机远程操控桌面端的agent。Perplexity在2月底发布了Perplexity Computer,一个能调度19个AI模型、在后台跑几个小时甚至几个月的agent工作台。Meta去年12月花20亿美元收购了Manus,3月中把它嵌入了广告管理后台和Telegram,下一步是WhatsApp。

连三星都在2月25日的Galaxy Unpacked上,把Galaxy S26定义为"the beginning of truly agentic AI smartphone"。手机里内置了Bixby、Gemini和Perplexity三个agent,长按侧键就可以让Gemini帮你叫车、点外卖、列购物清单,多步骤任务在后台自动完成。三星DX部门CEO TM Roh的原话是:一切颠覆性技术都走同一条路,先是被惊叹,最后变成infrastructure。

AI agent变成infrastructure。这是一家硬件公司说的话。

中国这边更疯

3月9日,腾讯一天之内推出五个AI agent产品。QClaw让你在微信聊天框里远程操控电脑。WorkBuddy是桌面端AI助手,兼容所有OpenClaw技能。云端版、企微版、QQ版同步上线。马化腾当天发了朋友圈,说公司现在有了一整套"龙虾"。腾讯股价当天涨了7.27%,是一年来最大单日涨幅。

同一天,字节跳动的火山引擎上线了ArkClaw,云端SaaS版本,深度集成飞书。你在飞书里跟一个bot聊天,它能直接读写你的飞书文档、管理日程、生成会议纪要。

3月10日,智谱发布AutoClaw,国内第一个一键本地安装版本,预装50多个技能。

3月11日,百度上线DuClaw,零部署,网页直接用。同一天百度北京总部搞了线下装机活动。

3月13日,阿里云的JVS Claw上线,个人AI助手。

3月17日,阿里通过钉钉发布了悟空(Wukong),企业级AI agent平台。同一天,阿里宣布成立"阿里Token Hub"业务集团,由CEO吴泳铭直管,整合通义实验室、千问、MaaS和悟空,全部收归一个组织。

3月18日,字节发布了ByteClaw企业安全版和内部安全使用指南。飞书也更新了自己的AI agent Aily,号称一键生成企业专属智能体。

还有MiniMax的MaxClaw、月之暗面的Kimi Claw、京东、华为、美团、网易有道、小米、360。

你没看错。三周之内,中国几乎所有叫得出名字的科技公司,都推出了自己的AI agent产品。

上一次出现这种密度的产品发布潮,是2023年初大模型军备竞赛。但那一次,大部分公司是在做demo。这一次不一样。这一次每一个产品都指向同一个东西:让AI通过你已有的聊天软件,操控你的电脑和工作流。


中国在抢的东西:入口

所有中国大厂在过去三周做的事情,归结成一句话:抢占AI agent的IM入口。

这个逻辑很清楚。AI agent需要一个界面来接收指令和返回结果。这个界面不是一个新的App,不是一个新的网页,而是你已经在用的聊天软件。微信、飞书、钉钉、QQ,哪个成为agent的默认操控台,哪个就拿到了下一个时代的入口。

腾讯的QClaw让你在微信小程序里给电脑发指令。字节的ArkClaw把飞书变成了agent的控制中心。阿里的悟空通过钉钉发号施令,还计划接入Slack、Teams和微信。淘宝的桌面端悄悄加了MCP协议支持,agent可以搜商品、比价、加购物车。

The Information报道,腾讯正在开发一个微信原生AI agent,会以联系人的形式出现在你的微信聊天列表里,通过自然语言调度微信小程序生态里的上百万个服务。打车、买菜、订餐、转账,都可以跟这个"联系人"说一声就完成。

如果这件事做成了,微信就不只是一个超级App。它变成了一个有AI大脑的操作系统。

地方政府也在加速。深圳龙岗区拿出最高1000万补贴"一人公司",就是一个人加一群AI agent组成的企业。无锡拿出最高500万补贴AI agent在机器人和工业领域的应用。深圳市政府给企业使用AI agent的费用报销40%,每年上限200万。

一个分析说得好:AI agent在中国火得这么快,是因为它给产业链上每个人都带来了收入。模型厂商获得了分发渠道,IM平台面对的是整合而不是被替代,云厂商卖出了更多算力。所有人的利益都指向同一个方向:让更多agent跑起来。

所以没有人有动力踩刹车。


美国在建的东西:围墙

大西洋另一边,反应完全不同。

前面提到的Anthropic、Perplexity、Manus,它们也在做agent,但做法和中国大厂有本质区别。Claude Cowork跑在本地沙箱里,文件不离开你的电脑。Perplexity Computer在自己的隔离环境里运行,不碰你的桌面。哪怕是Manus,也强调每一步操作需要用户明确授权。

而行业层面的第一反应,是安全警报。

微软安全团队发布报告,建议所有企业把AI agent当作不受信任的代码执行环境,只能在完全隔离的沙箱里运行。不能放在日常工作电脑上。

Gartner的分析师说这类工具"insecure by default",安全风险"不可接受"。Cisco的安全团队直接用了"security nightmare"这个词。

这不是杞人忧天。数据很具体:OpenClaw的技能市场ClawHub里,10700个第三方技能包,超过820个被确认是恶意的,接近20%。有人伪装成"Twitter技能包",实际上是一个多步下载器,安装macOS信息窃取恶意软件。全球有13.5万个agent实例暴露在公网上,其中1.5万个可以被远程执行代码。一个名叫MoltMatch的AI社交平台被发现数据库没有加密,泄露了3.5万个邮箱和150万个agent API密钥。

还有更荒诞的:一个计算机系学生配置了自己的agent去探索各种平台的功能,结果发现agent在他不知情的情况下,在一个AI约会网站上替他建了档案,还在帮他筛选对象。

微软自己也没能幸免。这个月微软确认,Copilot存在一个bug,会绕过企业数据防泄漏策略,把机密邮件内容摘要发给不该看到的人。

面对这些问题,美国大厂的策略不是"怎么让更多人用上agent",而是"怎么在agent上面加一层控制"。

Nvidia在GTC 2026上发布了NemoClaw,本质上是给OpenClaw套了一层安全外壳:沙箱隔离、策略引擎、隐私路由、网络防火墙。一条命令装好,企业级安全开箱即用。AWS在Lightsail上提供一键部署,但默认用Bedrock模型加上IAM角色和CloudTrail审计日志。

同一个开源项目。中国这边在比谁铺得快,美国那边在比谁管得住。


黄仁勋的判断

GTC 2026上,黄仁勋给AI agent下了一个定义。

他说OpenClaw是"人类历史上增长最快的开源项目",然后用了一个类比链:Linux,Kubernetes,HTML,OpenClaw。每一个都是开源基础设施,每一个都定义了一个计算时代的底层。

然后他说了一句更大的话:"Mac and Windows are the operating systems for the personal computer. OpenClaw is the operating system for personal AI."

个人电脑的操作系统是Windows和Mac。个人AI的操作系统是agent。

这句话的含义比它表面上看起来大得多。他说的不是"agent是一个很好的工具"。他说的是:agent是一个新的计算范式的底层,就像操作系统之于个人电脑。

他还用了一个例子来解释agent能做什么。你让一个agent帮你设计厨房,它不是给你一个建议然后等你动手。它会自己去学设计工具,自己出方案,自己审视方案的质量,觉得不够好就重新来,反复迭代,直到交出一个成品。

然后他说:"Every carpenter can now be an architect. Every plumber will become an architect. We are going to elevate the capabilities of everyone."

每个木匠都可以做建筑师的事。每个水管工都可以做建筑师的事。AI会把每个人的能力边界往上抬一层。

这句话在GTC的语境里是乐观主义叙事。但它有一个没说出来的另一面:当每个人都能做建筑师的事的时候,建筑师这个职业的护城河在哪里?

黄仁勋没有回答这个问题。他不需要回答。因为无论答案是什么,更多的agent意味着更多的推理算力需求,而Nvidia卖的就是算力。


两种策略,同一个赌注

中国抢入口,美国建围墙。看起来是两种完全不同的策略,但它们押的是同一个赌注:AI agent会成为下一个计算范式。

区别在于时间偏好。

中国的逻辑是:窗口期很短,谁先占住入口谁就赢了,安全问题以后再补。所以三周之内所有人冲上去,补贴、装机、一键部署、小程序集成,能做的全做了。中国工信部发了安全警告,国企和政府机关被限制使用,但民间的热度完全没有受影响。

美国的逻辑是:agent的权限太大了,如果不先解决安全和治理问题,后面会出大事。所以先建沙箱、先做审计、先搞合规框架,然后再慢慢放开。

谁对?短期看中国的速度优势很明显。长期看,安全问题是真实的,不是可以永远推迟的技术债务。但历史上,速度和安全之间的权衡,往往不是谁"对"的问题,而是谁的系统能更快地在跑的过程中修补自己。

中国在2010年代的移动互联网浪潮里,用的就是这个策略:先跑起来,边跑边修。微信支付、共享单车、外卖平台,都是先做到几亿用户,然后再解决监管和安全问题。这次的AI agent潮,看起来在走同一条路。


为什么这次比ChatGPT更重要

ChatGPT改变了人和信息的关系。你可以用自然语言获取、整理、生成信息。但你还是得自己去执行。

AI agent改变的是人和执行的关系。你说一句话,agent帮你做完。不是给你建议,不是帮你写草稿,是直接做完。读邮件、发邮件、订机票、整理文件、跑数据、写代码、发帖、管日程。你在手机上发一条消息,电脑那边就开始干活。

这是一个本质不同的东西。ChatGPT是一个更聪明的搜索引擎。AI agent是一个不需要睡觉的员工。

黄仁勋把它比作操作系统不是随便说的。操作系统的意义不是让你看到信息,而是让你操控资源。从命令行到图形界面到触屏到语音,每一次人机交互范式的变化,都重新定义了谁能使用计算机、用来做什么。

现在的变化是:操控计算机的界面,变成了聊天窗口。你不需要学任何软件的操作方式,你只需要会说话。

这就是为什么所有大厂都在抢IM入口。聊天窗口不是agent的附属品,聊天窗口就是新的操作系统界面。


远征

过去三周的密度,不是偶然的。它是多个趋势同时到达临界点的结果:模型能力够了,开源框架成熟了,IM生态准备好了,用户需求积累够了,资本也到位了。

这不是一个产品的爆红。这是一个新的计算范式的起点。

ChatGPT出来的时候,很多人说"这就是iPhone时刻"。三年过去了,那个类比没有完全兑现。AI确实改变了很多事,但它没有像iPhone那样创造一个全新的应用生态和商业模式。

AI agent有可能补上这一块。当agent真的能通过你的聊天窗口操控你的数字生活,当围绕agent的技能市场、安全框架、企业部署方案全部成型,那才是真正的iPhone时刻。

现在还不是。现在是2007年1月,乔布斯刚在台上掏出那部手机。

东边在抢速度,西边在建秩序。养法不同,但赌的是同一件事:这只龙虾会长大。

2026年3月20


主要信息来源:CNBC、Fortune、Caixin Global、TechNode、Yicai Global、KR-Asia、Stratechery、TechCrunch、Nvidia GTC 2026官方博客、OpenClaw官方文档。

Follow my WeChatWeChat 公众号 QR codeScan to follow