首页上那个「AI 可见度」模块,如果还停留在「在豆包问一句、在 ChatGPT 问一句」的阶段,说明它已经跟市场脱节了。10 月 5 日网经社联合 ChatGlobal 发布《通用大模型人气周榜 TOP20》,榜单出现了发布以来最大的一次变局:豆包以 143.6 的人气指数登顶全球第一,成为首个排在榜首的国产大模型;Perplexity 空降第二位;文心一言从榜外跃升至第三。而此前长期占据头部的 ChatGPT 与 Gemini,一周之内双双跌出前三。
这不是权威排名,但它反映的变化值得关注:用户每天真正打开的那几个入口,正在换人。
榜单会跳,习惯不会
先把性质说清楚。它统计的是「周度探索与交互点击」,本质上是人气而非质量,假期节点的活跃度、一次产品更新都能让名次大幅波动。ChatGPT 从上周 206.0 的峰值滑到 77.2,这种幅度在周榜里并不罕见。
但有一层东西比名次稳定得多:用户的使用习惯已经迁移了。CNNIC 10 月 8 日的报告显示,国内生成式 AI 用户突破 7 亿、普及率超过 50%,回答类使用占 76%,AI 搜索引擎首次进入最常用应用前三。当入口从搜索框整体搬到对话框,GEO 要盯的就不再是名次本身,而是「这个平台有没有在替用户回答我的问题」——一旦它的活跃人群足够大,你在里面缺席就是实打实的损失。
漏掉一个平台的代价,是静默的
平台间的一致性远没有直觉里那么高。同一个品牌,在豆包、DeepSeek、Kimi 里问出来的推荐名单经常对不上;跨到海外平台,名字写得对不对、产品线全不全、关键数据是不是同一版,又是另外一套说法——国内模型与海外模型的信源池不同,答案自然不会一样。
麻烦的是,这些缺口不会自己冒出来。后台看不到异常,流量也没有突然下跌,只是那部分用户在提问时根本没看到你。报表上的平均分,盖不住平台之间的落差。
每次监测名单变动,至少要盘三件事:
- 活跃人群是不是真的够大。行业报告里反复出现的名字,未必是用户真正在用的那个。
- 它引用的信源池和现在覆盖的重不重合。豆包的消费决策答案大量来自抖音生态,元宝把公众号与视频号摆上了明面——不重合就得单独补内容,别指望换个平台同一批稿照样管用。
- 它是人机问答还是 Agent 任务。Kimi 探索版、Perplexity 桌面端这类入口已经跑起多步检索,被提到只是第一步,内容还得是机器能直接取用的形态。
名单维护,按季度走一遍
建议在监测清单里固定一栏「新增候选平台」,不要等出了新工具才临时补:
- 新增候选:看行业周榜、应用商店排名与公开月活,先把名字挂上,别急着全量测
- 抽样复测:固定一批核心提问,在新平台上先跑一轮,看有没有系统性缺失
- 正式纳入:连续两轮都有稳定结果再重配预算;波动太大的平台先留在观察区
- 定期淘汰:连续两个季度没有实质流量或引用产出的平台,从主清单里摘掉
这套节奏比「哪个火了就冲哪个」慢一点,但换来的是名单长期可用。
别被名次带着走
周榜最会做的一件事,是制造「必须马上进场」的紧迫感。但 GEO 从来不是平台少就好做——漏掉一个有真实用户的平台,代价远比多测一个平台高。
真正的做法是把榜单当成输入而不是指令:名次记下来,平台挂上候选清单,用两轮平均活跃度、信源重合度和提问覆盖做判断。入口会一直换,能留下来的只有一套固定口径的监测节奏。