同一款AI办公 月活差出三倍
上周翻资料,撞见一件挺离谱的事。同一款 AI 办公产品,同一个 7 月,我能查到五个不同的「月活」。
上周翻资料,撞见一件挺离谱的事。
同一款 AI 办公产品,同一个 7 月,我能查到五个不同的「月活」。最小的 658 万,最大的 2000 万,差了整整三倍。
我不认为谁在造假。真相比这个有意思。
「月活」这个指标用了十几年,一直是争议最小的那个。套在 AI 办公身上,它已经测不准了。而这一轮所有「行业第一」的口号,恰好都建在它上面。

同一款产品的五个数字对比图(658万 / 1115万 / 2097万次 / 1200万 / 2000万)
一、五把尺子
都是同一款产品,腾讯的 WorkBuddy。
同一个 7 月,两家都写着「月活」,一家 658 万,一家 1115 万,差 1.7 倍。易观那个 2097 万,口径原文写的是「月访问量」,单位是次,不是人。
一份报告写清楚的事,到第二个环节就开始糊。
二、一个数字的传播之旅
最值得讲的,是那个 2000 万。
7 月 6 日,ChooseAI 发文,称根据易观数据,WorkBuddy 全平台 MAU 到 2000 万。同日,格隆汇等媒体跟进。
然后花旗的研报出来了,写的是,多家媒体报道称,根据易观最新追踪数据,WorkBuddy 跨平台 MAU 达到 2000 万。
7 月 20 日,易观自己的正式报告发布,写的却是,WorkBuddy 6 月 PC 端月访问量约 2097 万次。腾讯二季度业绩材料用的英文是 monthly interactions,月交互次数。
2097 万「次」和 2000 万「人」,是两个量纲。同一个用户一个月点开 20 次,产生 20 条访问记录,可他只是 1 个月活。
每过一道手,权威感升一级,口径被换一次。到投资者手里,它已经成了「花旗研报说月活 2000 万」的共识。

2000万月活的传播路径时间轴
三、考第一的那家,月活只有六十万
能力和月活,两张榜几乎是倒过来的。
8 月 19 日前后,杰富瑞发了一份 AI Agent 研究报告,把中美八款主流产品拉到一起,用五类真实办公任务逐个打分。
考第一的千问办公,7 月 PC 客户端月活是多少。QuestMobile 报的是约 60.8 万,AI产品榜给的是 60.79 万。这两家平时差得离谱,在它身上倒是出奇一致。
我不是要拿这张榜去骂谁。杰富瑞把分数拆成了两层,一层是模型的智商,一层是模型外面那套工程机制,它叫 Harness。千问的底座模型智商分只排第四,加上 Harness 才补到 95。这块东西,月活榜一个数字都测不出来。

能力榜与月活榜的倒挂对比图
四、为什么月活测不准了
三个原因。
第一,AI 不长在独立 App 里。 豆包连着抖音,千问连着淘宝和高德,元宝连着微信。用户是为 AI 来的,还是刷着顺手点了一下,谁也分不清。同样是豆包、同样是 6 月,新京报 AI 研究院给的是 5.28 亿,QuestMobile 给的是 3.82 亿,差了 1.46 亿。
第二,同一个人算几次。 一个人可能同时在用 PC 客户端、网页、小程序和企业 IM 里的入口。只算独立端,和全平台都算,数字天生不是一回事。
第三,指标被偷换。 月活是人。月访问量是次。月交互次数还是次。累计用户数是人次。四个词,四个量纲,读起来却差不多顺。

三条让月活失真的机制图
五、厂商自报的数,更得留心
8 月 14 日,百度宣布库库 AI 办公月活超过 2500 万。这个数是从 GenFlow 那 1 亿月活里筛出来的办公场景用户,凭什么算「AI 办公」用户,公开材料里没给定义。
9 月 4 日,阿里宣布千问办公上线满月,用户数突破 3000 万。这里要抠三个字,是「用户数」,不是「月活」,而且是首月累计。
巧的是,AI产品榜同期写,国内 AI 办公桌面端月活总量约 3000 万。一个是全行业一个月的活跃人数,一个是单款产品一个月的累计用户,放进同一个标题里,读起来差不多,含义天差地别。
六、谁的数字能信
规律挺清楚。越靠近自家宣传,尺子越松。越靠近第三方监测,尺子越紧。
而最松的那把尺子,往往传播得最远。
七、普通人怎么用这些数字
以后看到「月活第一」,先问三句话。这个数是人还是次。算没算那些寄生的入口。谁测的。
三句话问下来,一大半的「第一」会自己松掉。
真要挑工具,我更愿意看人均使用次数。QuestMobile 那份报告里 7 月的数据是,WorkBuddy 人均用了 19.0 次,QClaw 13.6 次,TRAE Work 8.8 次,Qoderwork 5.7 次。
一个人一个月愿意主动点开 19 次,这比「我们月活多少万」实在。

从月活到人均使用次数的指标迁移图
数字会打架,工具不会。你自己的手感,才是最后那把尺子。
- 暂时没有评论,来说点什么吧





