最近又有两篇英文实操文章把 Ahrefs 的一组数据重新翻出来算账,结论值得每个做 GEO 的人再看一遍:Google 排名好,已经不能预测 AI 会不会引用你。

这组数据的原始样本不小:86.3 万个关键词的搜索结果页、约 400 万条 AI 概览(AI Overviews)引用记录。统计下来,被 AI 概览引用的页面里只有 38% 同时排在 Google 前 10——而上一轮同类研究里,这个数字还是 76%。一年左右,从「大概率重合」跌到「四成不到」。

助手类引擎更不看你排第几

如果只看 Google 自家的 AI 概览,还能说「毕竟同一家」。把范围扩到 ChatGPT、Gemini、Copilot 这类助手引擎,脱钩更狠:同一批 1.5 万个长尾提问,助手引用的链接里只有约 12% 排在 Google 同一提问的前 10,Perplexity 是 28.6%。换句话说,大部分助手引用的页面,对你问的那个问题在传统搜索里根本不参与排名。

学术侧也有印证。波鸿鲁尔大学与马普所的一篇预印本统计了 AI 概览的被引来源:53% 不在自然结果前 10,40% 连前 100 都不在;Gemini 引用域名的中位位置,落在了独立域名榜单 Tranco 的前 1000 名之外。

脱钩变大其实不难解释:各家引擎都养了自己的检索层和信源偏好,AI 概览大量引用维基百科、YouTube、社区帖这类第三方页面;而助手回答走的是自有索引,连「提问怎么措辞」都和关键词排名不是一回事。你按搜索关键词排上去了,AI 那边问法一变,召回到的可能完全是另一批页面。

排名报表不能再当代理指标

  • 别用排名倒推 AI 表现。 过去很多团队的口径是「关键词排上去了,AI 那边问题不大」,这几组数据说明这个假设已经站不住,排名和被引要当成两列分开看。
  • 核对引用要直接抽 AI 的回答。 与其从排名数据猜,不如每月固定抽一批核心提问——品牌词、品类词、对比题各留几个,逐条问各平台,记录实际引用了哪些页面、自家域名出现在哪、排在引用列表第几位。抽检结果落成表格,两三个月就能看出趋势。
  • 被引页要单独养护。 拉一张「被 AI 引用过的页面」清单,盯它们的收录状态、内容时效和引用来源变化。这张清单的优先级,应该高于再堆一批新稿。

别急着推倒重来

需要说明,这组数据是相关观察,不是因果结论,不同研究因提问样本不同,数字也会有出入。它传达的不是「SEO 没用了」,而是排名只是前提,引用另有一套筛选逻辑:页面得被爬到、被读懂、有值得摘的段落。基础优化照做,但验收标准要换成「AI 实际引用了什么」,而不是「我排第几」。