答案引擎又换发动机了。9 月 22 日,OpenAI 在 API 更新日志里正式放出 GPT-6 Sol 和 GPT-6 Luna 两款新模型,随后几天陆续铺进 ChatGPT Work 和 Codex,免费用户在桌面端也会被切到 Luna。价格是这次最显眼的数字:API 定价比上一代 5.6 系列的促销价直接砍掉一半——Sol 每百万 token 输入 2 美元、输出 10 美元,Luna 更是低到 0.1 美元和 0.5 美元,上下文窗口拉到 105 万 token,网页搜索、文件搜索这些工具能力全都带上了。

很多做品牌 AI 曝光的人看到这类消息,第一反应是「又发新模型,跟我没关系」。恰恰相反:AI 答案里提不提你、引不引你的内容,最终是模型层在做判断。模型一换,同样的提问、同样的内容池,答案结构和引用偏好都可能悄悄变样。

换的不是界面,是「判断内容好坏的那颗脑子」

OpenAI 这次给 Sol 的卖点是事实错误率约为上一代的一半——按官方说法,这个数字来自真实对话里用户标记答错的样本。错误率降一半意味着什么?意味着模型对「不确定的内容」会更谨慎,宁可少说、换个信源说,也不硬编。那些靠模糊表述、堆关键词挤进答案的内容,可能会先被挤出去。

另一个容易被忽略的点:Luna 的知识截止时间更新到了 2026 年 5 月。知识截止一变,模型对「最近发生的事」的认知边界就整体平移——之前答案里「不知道、查不到」的部分,现在可能直接给出新说法。你的品牌近几个月在网上的新增内容,会更快进入它的认知。

对 GEO 真正有影响的三件事

  • 引用行为会漂移。新模型对信源的挑选标准变了,同一组问题重跑一遍,被引用的网站名单很可能和上个月对不上。这不是你的内容退步了,是裁判换了。
  • 便宜会带来更多提问。推理成本砍半,各家用模型做检索增强、Agent 分发的成本也跟着降。此前行业数据已经证明「问题变长、变具体」的趋势,成本再降一档,长尾问题会更多打到你身上——页面越全,接得住的长尾越多。
  • 监测数据需要重新对表。9 月 22 日前后是分水岭,这一天之后的引用数据和新模型有关,之前的归旧模型。混在一起看趋势,结论基本不可信。

这一周值得做的三个动作

  1. 把切换日之前的可见度报表存档,标注「旧模型基线」,之后所有对比都基于 9 月 22 日之后的数据重新起算。
  2. 把你日常盯的那组核心问题重跑一遍,记录新答案里谁被提到、谁被引用。名单变了先别慌,连续观察一周再下结论。
  3. 顺手盯一下导流数据。如果 ChatGPT 带来的访问出现无明显内容改动的跳变,先查模型切换,再查自己的内容——很多时候不是你做错了什么。

模型更新从来不会提前通知谁。对做 GEO 的人来说,最贵的不是没赶上新闻,而是拿着两套口径混出来的报表,做错下一步预算。