
个人代理并不是新时代,仅仅是一次次子们的复仇。
大家好,欢迎收听老范讲故事的YouTube频道。
个人代理一下火了:从马斯克的Grok Bot,到Meta的Muse、OpenAI的Dots,这两个月冒出了五六家。AI自己有了邮箱、电话和钱包。但是这不过是一次次子的复仇。我的判断先放这:这一波个人代理,是一帮在主战场上没有打赢的次子,拿着流量、便宜的算力和差那么一点点的模型,冲着长子Anthropic发起的反击。它真正砍的是长子的token消耗;OpenAI还嫌不够,又在收入上多捅了一刀。至于个人代理本身,比我们以前玩的OpenClaw、Hermes Agent其实并没有强出多少。
今天分几段来讲:第一段,这一波个人代理到底是个啥;第二段,谁是长子,为什么说这是次子的复仇;第三段,次子们的刀为什么砍在token消耗上;第四段,OpenAI多捅的那一刀,一下砍了200亿的收入,到底是怎么回事;第五段,这场复仇最后会有一个什么样的结果。
个人代理为什么突然刷屏
这一波个人代理到底是个啥?8月11号,马斯克先上了Grok Bot。不过Grok Bot并没有那么火,毕竟他手里的初始用户和初始流量没有那么大。真正刷屏的是9月8号Meta发的Muse:上线10天,就把ChatGPT从美国App Store免费榜第一的位置上拉下来了。Meta的首席AI官亚历山大王,在Muse上线两个多礼拜后就在x上发了300多条帖子。现在一堆人追亚历山大王的成功学,我觉得纯属扯淡。跟学霸学学习方法,人家十几岁就会微积分,你未必学得会。讲远了,但这也可见Meta的Muse到底有多火。
Muse火了,主要靠两点。第一,它走的是个人代理的路,不是让你办公,而是帮你买东西、付钱。付钱的时候,它让Stripe生成一张一次性的卡号,商家拿不到你真正的信用卡。第二点,Meta的流量实在太大了,Muse直接塞进WhatsApp,一下就刷屏了。再往后,9月29号OpenAI也跟进,出了Dots;前后脚,过气了的Manus也出了一个叫Cue的产品。每个代理都配有自己的邮箱、电话号码、钱包和电脑。10月8号,谷歌说要在谷歌云的企业产品里加这种东西,叫企业虚拟员工。国内字节、阿里,包括腾讯,据说也都在跟进,这个后边再讲。

个人代理这个概念其实并不新鲜。前面我们玩的OpenClaw,再往后的Hermes Agent,都属于个人代理;OpenClaw在国内叫龙虾。传统的个人代理有一台独立主机,一般是虚拟主机,也可能是真实的物理主机。在这台机器上,OpenClaw也好,Hermes Agent也好,有独立的身份、全套账号和所有的权利,可以联网,替你用浏览器、用电脑,拥有长期记忆,还能做agent编排,指挥一堆小agent干各种事情。这就是传统的personal agent。
Muse、Dots、Cue拆开来看,干的其实都是同样的事情。龙虾在国内火过一阵,大家一窝蜂冲上去养;可是到9月24号,腾讯的QClaw直接宣布12月24号停机,不玩了。前两天21财经上还有篇文章。标题叫做《Muse狂飙,龙虾退潮》,说“全民养虾运动”画上了句号。东西不新,新的是谁在做。
谁是长子,谁在打低价牌
为什么说这是次子的复仇?谁是长子呢?现在的长子只能是Anthropic。论岁数,它是2021年从OpenAI里拆出来的,绝对是弟弟;可是论家业,它现在真的是老大,挣钱挣得嗨嗨的。去年年底,Anthropic的年化收入才只有九十亿美金上下;今年5月,它自己的公告说过了470亿美金;7月它跟投资人说,已经过了650亿美金。7个月涨了7倍多。模型这一头,在评测上未必全面领先,但真实体验上,Anthropic Claude Opus 5.5绝对遥遥领先。
次子们有什么特点呢?挣的钱没有Anthropic多,模型没有Anthropic好,但是手里有别的东西。比如Meta有巨大的流量,xAI有超便宜的算力。在这种时候,他们就会去做个人代理。算力有多富裕?马斯克这头算力多得都开始往外租了。5月6号,Anthropic宣布把SpaceX的Colossus 1数据中心整包租下来,22万块英伟达的卡。长子还得找次子租算力。
次子们根据自己的位置拿出了不同的东西。看位置,最简单的方法就是看门票:每家的个人代理使用门槛不一样,越差的门槛越低。先看Meta,Muse是免费的,只要在美国,你就可以免费用这东西。为什么免费呢?因为Meta的模型是完全落后的。Muse背后的模型叫Muse Spark,Meta说它是迄今为止最强的模型,可咱们见过谁单独用这玩意没有?就算发模型都没人用,那干脆免费,拿流量来砸。
前边靠这个成功的就是豆包。字节跳动也是靠免费的豆包,直接拿到了中国AI Agent的第一名。免费的东西从来不是礼物,那是入口;所有用这个东西的人就是羊毛,大家一定要搞清楚。

再看马斯克。Grok还是有人用的,也还有一些声音,在这一点上要比Meta的Muse Spark强一些,所以它没有给免费的,而是给一个相对便宜一些的入口。但是现在SpaceX的这个入口还在进行调整。想要使用Grok Bot,大概有几个价格:第一个是购买xAI上面30美金的套餐,买了就可以用;第二种是买Cursor的套餐,原来是20美金,昨天我看好像到25美金了。
现在也有传闻,马斯克准备统一内部的所有套餐。说一句题外话,一个公司如果没有办法统一内部的套餐,就不用继续玩下去了。看看现在小米,桌面套餐跟编程套餐是分开的,统一不了;字节一大堆套餐也统一不起来,再往后走会很痛苦。但是说回来,想用马斯克的Grok Bot还是要交钱的。
再看OpenAI。Dots要订Pro,100美金以上才可以开始用,20美金的Plus不让用。这说明什么呢?我虽然现在一时不敌Anthropic,但是我还是打得有来有回的,那就可以挂一个更高的价格让大家来用。门槛越高,就说明它离长子的位置越近;门槛越低,特别是免费用的,就属于“我已经不行了,那咱就破罐破摔吧”。所以这一次的价格,或者叫门票,非常非常清晰地体现了各位次子们的排序。
谷歌这一家,现在基本上可以当笑话来看了。到目前为止,Gemini 4就没有发布的迹象。Google Workspace里头确实有很多账号,很多公司完整的办公体系都在里头,那它就干脆在Gemini企业版这个虚拟员工有自己的身份,比如自己的邮箱、日历和网盘;你在Google Chat里点它的名字,它就出来干活。可是这东西10月8号才宣布,只给一小撮用户私下测试,大部分人根本用不上。
就跟最新发布的Gemini 4这个版本一样,普通人压根用不了。别人都在抢个人用户,谷歌只盯着办公,而且产品压根没放出来,所以我说把它当个笑话来看没有任何问题。通过入门门槛,我们就看到了各个次子的座位。
模型调度怎样砍向长子的token
次子们手里的刀到底砍长子的什么地方?先说一件事:个人代理的模型不需要那么强,因为你可以做模型调度,可以做多agent编排,哪些地方用差一点的模型,哪些地方用好一些的模型,都可以分得清清楚楚。就算模型差一些,也可以多注入上下文,多加约束,再加几道检查和校验,一样能够拿到满意的结果。所以这东西对于模型能力差一些的公司更友好,对中国公司其实也更友好。个人代理拼的并不是谁家的模型最强,而是谁更会调度。
大家看xAI九月21号出的Grok 4.7。它自己讲的重点是什么?这个模型经过专门训练,天生能够看懂Grok Bot这一套驾驭系统。在对比表里,马斯克已经不再喊自己第一了。原来他天天喊自己的模型超过OpenAI、超过Anthropic;现在不再强调评测超过了谁,或者大家用了以后感觉超越了GPT、超越了Anthropic。这一套东西,我们原来给它起过一个名字,叫Harness Agent,也就是带驾驭系统的agent。
它最适合各种Flash模型,比如Gemini Flash、DeepSeek V4.1 Flash、GLM 5.3 Flash,包括我现在用的MiniMax M3.1 Flash。这些模型速度快、价格便宜,在很强的驾驭系统下面可以稳定工作。最先笑的,是手里没有顶级模型,却攥着一堆便宜算力的人。

DeepSeek走得最彻底。9月10号它发了V4.1 Flash,自己说在agent任务上比自家的旗舰更强。从9月14号起,所有使用V4-Pro的请求都转给Flash,而且按照Flash的价钱计费,旗舰直接给Flash让位了。马斯克这头走得更远:10月7号他在x上说,以后SpaceX会给每一个任务挑最可能带来好结果的后端模型,包括Claude Opus 5.5。重活扔给Claude,画图交给Midjourney,音乐交给Suno,其他调度的事情用Grok 4.7就可以干得很好。谷歌那个虚拟员工也是一样,现在就能用Anthropic的Claude模型。
在驾驭系统里,模型变成了一个能够替换的零件。谁握着客户,谁就能决定什么时候买长子的token、买多少。Anthropic的模型跑在亚马逊云、谷歌云,也跑在马斯克自己的Colossus云上;这些平台在自己的系统里调用一些,或者直接替它卖掉,本身是说得通的。
第二件事,个人代理会极大地降低token消耗。为什么?自己选模型的时候会怎么选?比如我用Opus 5.5,再开一个非常高的推理强度;我不会开Max,因为Max贵得多,我会选extra。这样做是想一次性拿到很好的结果,其实并不明智。但是对Claude来说,这非常划算:甭管我今天只是跟它说你好,还是让它做很复杂的事情,它都按照最贵的方式向我收钱。
上了个人代理以后,选模型这一块它替你来做:什么情况下应该用便宜的模型,什么情况下应该用判定模型,因为判定模型现在最便宜;什么时候用中等推理的模型,它都可以自己去做判定。我现在有的时候也会让它对我的技能做优化:在做确定性事情的时候,请用便宜的模型;在做有创造力的、难的事情的时候,请用最好的模型、最高的推理。它们也可以做这样的编排,但是绝大部分人其实都是直接用最贵的模型做各种简单的事情。
Manus自己也在说,新的那套agent系统里,token少用了23.2%,跑一个任务的成本节省了32%。你省下来的就是长子少赚的。而现在需求并没有大爆发,新活没有多出多少来,每个活用的token又在往下砍,对于长子来说,这就是最疼的。

Anthropic与OpenAI的两难
那长子干没干这事呢?Anthropic其实没干,一张像样的牌都没有。它那边跟personal agent最像的东西,是6月底在Slack里推出的Claude Tag:你在工作群里at它,给它派活,管理员还能够给不同的团队设不同的身份。可是它就活在一个工作群里,跟前面那些有自己电脑、自己钱包、完整权限的个人代理比起来,简陋太多了。Anthropic现在最强的就是模型体验特别好。Claude也能够在云端替你跑任务,可是用哪个模型、开多高的推理,你还是要自己挑。在自己挑的时候,用户会非理性地选择最好的模型、最高的推理。Anthropic就希望你干这个事:甭管你是订阅它的套餐,还是买它的token,都来用它的模型。
这就是长子站在一个被攻击的位置上不得不采取的做法,它只能继续被动地往前走。而且它现在正在准备上市。路透和CNBC报道,目标是11月挂牌;纽约时报说,要募的钱可能高达1,000亿美金,市值可能达到2万亿美金,又是一个史无前例的数字。任何公司到了上市这个时间点都会变得比较虚弱:从一家私营公司往公开上市公司转换,要接受审计,也要接受大家的挑剔。这是一个很危险的时间,通常不会做特别大的变化。比如把自己变成个人代理,一变以后,前面那些收入就没了,或者打一个很大的折扣;我认为它绝对不会干这个事。
其实这事对于老二OpenAI来说也没有那么划算。OpenAI想干,但是又怕自己的收入被带崩,所以搞出了100美金门槛、必须用GPT-6 Astra干活的策略。Dots官方写着由GPT-6 Astra驱动:第一个dot含在套餐里,跟它聊天不算用量,可是dot派出去的活照扣你的额度。OpenAI的个人代理仍然是在帮你花token。
个人代理对于传统AI厂商最大的伤害就在这里:它可以用差一些、便宜一些的模型干同样的事情,甚至拿不同的模型来搭配,把事情做好;它把token消耗压下来,还把最好的模型跟自家模型之间的差距,在用户感受上抹平了。这一刀捅的是所有卖token吃饭的厂商,长子首当其冲。次子的复仇刀就砍在长子的token消耗上。那OpenAI除了Dots还做了什么?
两百亿美金:收入数字背后的口径
这个时间点,OpenAI又出来搞事情:年化营收一下少了200亿美金。原来外边都说这是700亿美金,后来变成500亿了,其实干的是同样的事情。怎么解释呢?700亿其实并不是OpenAI自己宣布的。9月29号,Axios做了这样的报道,用的是匿名信源;后来有看过投资人材料的人跟CNBC确认,这个数从来不是OpenAI自己出的,是投资人按照Anthropic的算法替它折算出来的。
为什么要折算呢?因为我们做投资的时候,最喜欢干的一件事情叫同业比较。为什么要干这事呢?因为投资的时候,大家都没有上市,没有市值,都是估值,那怎么能估得准呢?就找一个跟你干差不多活的同行业公司:它挣了多少钱,是多少估值,把这个数算出一个比例;你干同样的事情,挣了多少钱,把这个比例往上一乘,不就有估值了吗?
所以在这个时候就要做同业比较,而且要用一个相对比较对齐的做法:Anthropic是怎么算的,OpenAI也照这个算,这样才能比较出来,你们两家的估值是不是一样的水平,或者这个倍数是不是合理。OpenAI自己认下来也好,不出来反对也没毛病,但是它偏不。在我看来,它就是要让大家知道:我只有500亿。
10月8号,金融时报和Axios同一天爆出来,OpenAI跟投资人说,按照它自己的算法,到9月底,它的年化只有500亿上下。那这200亿差在哪呢?OpenAI有一部分生意是通过微软这样的云伙伴卖出去的,伙伴要分走这一块手续费。OpenAI的算法是,伙伴分走那一块就不算我的收入了,只算到我手里多少钱,这部分算我的收入。

Anthropic的算法正好相反:客户付钱了,全算我的收入;平台拿走那一块,计入成本就完了,算是一个销售成本。这两种算法在美国会计准则里头都是合规的。可现在大家都没利润,都在算PS,也就是市销率,收入高的那个肯定要占便宜。这就是Anthropic这套算法占便宜的地方。
那OpenAI为什么在这样的一个时间点出来捅这一刀呢?因为Anthropic要靠它来算PS,算完PS才有今年上市2万亿美金的估值。按照7月底那个650亿的年化来算,也就是30倍出头的一个PS,所以并不算特别过分。OpenAI就惦记着捅它这一刀,才整了这么一个幺蛾子出来,而且这一刀惦记的也不是一天两天了。
今年4月,OpenAI的首席营收官德雷瑟给员工写了一封四页的内部信,原话是他们报的年化被注水了,说Anthropic这个数虚了大概80亿美金。早就磨好刀了,而且这一刀还特别狠。OpenAI走伙伴卖出去的,在它整个收入里头其实占比并不是很高,大概占百分之十几;绝大部分是自己直接卖的,只有百分之十几是通过微软云卖出去的。
Anthropic这边的招股说明书里边写的,去年47%的收入是通过亚马逊和谷歌云卖出去的;以后xAI也要替它去卖,这一块的比例可能会变得更高。那大家自然就会去想了:OpenAI只有百分之十几走生意伙伴,这就差了200亿;Anthropic有将近一半是走云的,那得虚多少?这个其实有点杀人诛心,有点偷换概念。700亿本来就是一个没有依据的数字,是外面在传、猜出来的;OpenAI自己其实从来就没有挣出过这么多钱来。
我觉得,就算把微软那块服务费加进去,它也赚不到700亿。它可能能赚到6……550亿到600亿,应该也就这种水平。可要是真按着Anthropic的账来算,它也虚不出那么多来。平台大概抽多少手续费呢?大概16%。就是你通过平台、通过谷歌或亚马逊卖掉100万美金的算力,谷歌和亚马逊抽走16万美金。
路透社按照招股说明书的草案算过,去年Anthropic分给亚马逊和谷歌的大概也就是3.51亿美金,摊到今年也就是45.9亿美金上下,大概占它整个收入的7.6%,虚的连一成都不到。
一刀砍下去,谁先受伤
但是没想到这一刀砍下去,整个科技股都给带崩了。10月8号,英伟达跌了差不多3%,一天蒸发了将近1,700亿美金的市值;同一天甲骨文跌了5%还多,CoreWeave跌了7%。第二天东京开盘,软银盘中一度跌了7.3%。到了晚上的美股大盘才算涨回来,但是英伟达、AMD、ARM还在跌。
卖铲子的先挨了这一刀,伤的都是自己人。软银是OpenAI最大的金主,甲骨文是给它盖数据中心的人,CoreWeave是给它提供算力的,英伟达给它提供卡,还要在它身上投钱。这叫做搬起石头砸了自己的脚。这200亿是口径,不是生意;可就为了这一个数字,一堆人真金白银地被割了肉。

最后OpenAI也没办法,还得出来找补。10月9号,彭博从知情人士那拿到了消息:OpenAI跟投资人说,到年底年化至少能到700亿。早干嘛去了?到10月9号又说,我们到年底还是能挣到的,而且不止700亿,比这还多。刀可收不回来了。
这个事有点像中国的GDP到底有多少。按购买力来算,很多人都说,因为中国东西实在太便宜了,所以中国GDP其实早就超过美国了。但是GDP这种东西,包括这种年化收入,都属于经过高度抽象以后的一个简单经济指标。它会具备一定的代表性,但是你不能把它拆完以后再去四处比较;拿其中一部分数据以偏概全地说总体应该怎么回事,这个是有很大问题的。
OpenAI这一刀,目标非常明确,就是Anthropic上市。这也是次子复仇的一部分。
体验进步了,旧问题还在
那个人代理本身比以前的OpenClaw强了多少呢?有进步,但是并没有那么大。进步分三条。第一条,不用自己装了。原来咱们玩OpenClaw、玩Hermes Agent,最麻烦的就是安装、适配,这个太痛苦了。现在这些东西都由模型公司统一部署,对于绝大部分普通人来说,部署和适配的成本一下就清零了。
第二条,模型给你配好了。用的都是模型公司自己的模型,高速、低速、不同推理强度的,统一放在一个系统里头调度,给你做最省token、效果最好的方案出来。你不用自己在那修老爷车、修手动车了,现在直接给你一个傻瓜相机、自动相机,就可以直接玩了。
第三条,现在差距看不出来了。在这样的情况下,你基本上体会不出来它跟Opus 5.5或者GPT-6之间到底有什么差异。有可能最难的那部分,Grok Bot自动就去给你调Opus 5.5去了,你最后得到了一个完全一致的结果出来,而且你花的钱会少很多。
但是另外一头,原来OpenClaw和Hermes agent带来的那些问题,其实并没有得到解决。各种安全问题、隐私问题,还有跟现有流量体系不兼容的问题,并没有被解决掉。先说隐私吧,OpenAI自己写的安全博客上讲了,就算你把一个应用断开了后台研究记下来的笔记,官方不会直接拿去训练;可是dot回头在对话里读到这些笔记,这段对话能不能拿去训练,就看你的设置了。
马斯克那边写得更直白:同一个用户的所有Grok Bot共享一台电脑,你放在上面的登录信息和文件,请当成每一个BOT都能够拿到。风险写进了说明书,赌上去的是自己的账号、文件和聊天记录。钥匙交出去了,就收不回来了。

再说流量。9月20号,亚马逊把Muse挡在门外。用户让Muse去亚马逊买东西,弹出来的提示就是:未经授权的AI代理访问,违反亚马逊的使用条款。亚马逊还说,Muse在它的网站上逛的时候,没有声明自己是AI。亚马逊不是头一回这么干了:去年11月,它把Perplexity告了,不让人家的AI浏览器在亚马逊上替用户买东西。平台在封,法院也在介入。苹果这边也出手了,要收紧macOS上完全磁盘访问的权限,理由是AI代理越来越自主。
网站为了防爬虫、防攻击,都要求明确区分访问者到底是真人、爬虫还是AI。对网站来说,AI也是爬虫,必须说清楚,不能模拟真人进去;有些服务只面对真人开放。你以为请了个管家,在网站那头,人家却把它当爬虫。OpenAI管ChatGPT的蒂博·索蒂约上了拉奇茨基的播客。那期节目介绍写着,他会讲为什么agent将主导互联网流量,为什么Dots是OpenAI最大的赌注。话说得很满,可是Dots只给付费100美金以上的人用;个人用户里,欧洲、英国和瑞士都不能访问。OpenAI在这一块也有点三心二意,并没有那么努力地推广Dots。
会不会有专门给AI agent开放的网站?也许会有,前提是出现适合AI agent交易的场景或品类,而且这些场景和品类壮大起来,才能承接这类流量。如果还是传统的买东西、订餐厅,这条路未必走得通。至于个人代理最后会不会成为潮流,我个人的看法是,可能还要等真正适合它的场景产生之后才能断定。
中国市场会不会跑出新场景
Meta的Muse针对美国用户免费开放,有机会孵化这样的场景,也确实在做。亚马逊把门关上没几天,Meta就拉上沃尔玛、百思买、丝芙兰,再接上Shopify和PayPal,让Muse直接替你下单。这就是在养场景。不过我个人觉得,更有可能孵化出真正适合个人代理场景的地方,应该是在中国,因为这里竞争更激烈,提供服务的人也更愿意贴合能获得流量和交易机会的场景。
已经有动静了。9月22号云栖大会上,千问宣布加速做personal agent;申请入驻其开放平台的合作伙伴已经超过1,000家,服务方正抢着往上贴。腾讯云在做一个叫LightVela的云端常驻代理。字节这边,网上有博主爆料,说豆包团队中秋节没有放假,正赶一个对标Muse的APP;字节官方没有确认。Manus在做Cue的同时,也组了一支面向中国市场的团队。
字节、阿里、腾讯手里攥着中国最大的流量和交易场景,它们下场,才是这场复仇真正的变量。就像互联网和移动互联网时代,中国曾靠模式创新先跑出来一样,我认为个人代理在中国先跑出来的概率也相对大一些。期待这些公司拿出自己的personal agent。
最后收一下:这一波个人代理本身并没有比OpenClaw强多少,变的是谁在做、冲着谁做。个人代理不是新时代,只是次子们的复仇。
今天的故事就讲到这里,感谢大家收听。请帮忙点赞、点小铃铛,参加Discord讨论群;也欢迎有兴趣、有能力的朋友加入我们的付费频道。
再见。
背景图片
