你手上那套 GEO 打法,可能是照着一篇 2023 年的论文做的。
那篇论文给生成式引擎优化起了名字,也给了最出名的三招:在正文里加引用、塞统计数字、引第三方来源。它的结论很吸引人——按这三招改过的页面,在 AI 回答里的占比能提升三到四成。于是两年里,无数「GEO 怎么做」的文章都从这一句抄起。
问题在于,那篇论文没有测「有没有被引用」。它做的是把谷歌前几条结果喂给一个老模型,看模型的回答里你的内容占了多少字。2026 年 9 月,两家做 AI 可引用性评分的机构拿这招重做了一遍实验,结论是:这三招在一个引擎上都没能改变引用,加第三方来源甚至让引用份额掉了 0.79 个百分点。
一个数字,三种说法
同一组「三到四成」的收益,如今在市面上有三种流通方式,只有一种还算老实。
- 论文原文说得清楚:实验是把搜索结果喂给单个旧模型,测的是回答里的篇幅占用,不是引用
- 二次文章把前置条件删干净,直接写成「按这几招做,AI 可见度提升 40%」
- 榜单文再补一句「研究证明」,剩下的读者自己脑补
关键在于「篇幅占比」和「被引用」根本是两件事:前者说模型写答案时用了你多少字,后者才决定你有没有出现在答案里、有没有被点名。前者没人能拿去算流量,后者才是要交差的那个数。
今年的复测,成绩单不太好看
今年公开的几轮复核,把几个流传最广的动作都打了一遍。
- 照 2023 年三招改写法:配对、控制篇幅的编辑,在十个引擎家族上都没能移动引用
- 加结构化标记:六百万条 URL 里带标记的确实更常被引,但在一千八百多个页面上做对照添加,多个引擎都没测出提升
- 冲字数:几轮相关分析都没发现字数目标与引用有关联,纯看字数改版面属于白干
- 加第三方来源:这是唯一测出明确效果的一项,方向是往下
- 改写正文本身:一个独立基准测过的公开方法,54 个案例里只有 3 个拿到显著提升
- 附带一句:总分式的「页面可引用性分数」,和引用份额的相关性只有 0.114
这轮研究方自己标了前提:把模型直接调接口测,不等于开放网络里带检索和去重的真实竞争;而他们本身也在卖页面评分。这份坦白应该照着抄——看到任何提升数字,先看它测的是什么。
现在能拿来做事的,只剩这几件
不聊玄的,落到动作上就四条。
- 信源整齐:标出来的日期、数字、口径,从头到尾不许打架。同一件事两个说法,模型宁可不用你
- 一页一题:一页只答一个问题,开头给结论,后面给证据。让模型能整段切走
- 对着问题写,别对着品类写:拿十来个真实提问去测自己的页面,别拿分数当指标
- 要提升就自己测:在你自己的场景里,对同一批问题跑前后对照,你自己测出来的才会成立
这行当现在的状态:教科书过期了
两年过去,行业已经从「谁会说概念」走到「谁能复现」。团体标准在细化,平台在收紧,论文也在互相打脸。对一个真在做品牌 AI 曝光的人来说,好消息是不用追新名词——判断标准变简单了:任何号称能提可见度的动作,先问它有没有做过对照测试。没做过,就当它是内容建议,不是方法。
至于那份 2023 年的论文,它依然值得读,只是得连着它的样本量和方法一起读。