9 月 24 日,Perplexity 官宣自研检索引擎 Photon:用 Rust 重写,全面替换原先的开源引擎,负责 Perplexity 全部检索与排序;同期在 Search API 上线 Fast Search,95% 的搜索结果 230 毫秒内返回,最慢档延迟(P99)从约 800 毫秒压到 65 毫秒。整个引擎是一支小团队带着几百个 AI 代理、花了约 30 万美元 token 写出来的。

多数人把这条消息当基础设施新闻划过去了。但对做品牌 AI 曝光的人来说,这是答案的上游在动。

检索是进货成本,进货便宜了

AI 给出回答之前要先「进货」:发起检索、取回网页、再合成答案。检索就是这门生意的进货成本。Photon 把这笔成本打了下来——官方口径,六项 agent 基准测试里单任务成本比默认档低 68%,质量基本持平;索引 2000 多亿个 URL,服务器还少用了 20%。

成本降六成意味着什么?同样的预算能检索更多次。做研究类任务的 agent 本来一个任务就要发十几次搜索,单价降下来,检索次数大概率跟着涨——效率提升往往换来用量膨胀。落到内容侧:你的页面被「翻到」的机会,正在从少数几次主查询,扩散到一长串子问题。

检索 API 成了货架商品,Shopify 已下单

另一条更值得注意的线:检索层在变成明码标价的商品。Perplexity 的 Search API 本来就是卖给其他 AI 应用调用的,这次发布后,Shopify 高管 Mikhail Parakhin 公开表态:Shopify 测评过各家搜索 API,Perplexity 是靠实力成了他们的主力。

这说明「能不能被检索到」的影响面在扩大。过去优化内容的可检索性,主要影响 Perplexity 一家的答案;等接了这类第三方检索 API 的电商、agent 和企业工具多起来,同一套检索能力会流向一堆你不知道名字的下游应用。内容的可检索性,正在变成横跨多个入口的公共底座。

三个跟着调整的动作

  • 铺长尾问题:检索变便宜,长尾子问题被单独检索的概率上升。把场景问题、参数对比、售前疑问做成独立、直给的页面,比把所有信息塞进一篇长文更划算。
  • 对结构更挑剔:官方测试也承认,Fast Search 在长尾和宽泛查询上,相关性低 0.24 分、答案可得性低约 3 个百分点。省成本的检索更依赖「一眼能抽出答案」的页面——结论前置、分段清晰、事实自包含的内容,在快检索里存活率更高。
  • 监测往上游挪一格:别只盯最终答案里有没有你。记录每个问题有没有触发检索、取回了哪些来源——上游的变化,比答案层的变化先到。

答案的竞争,正在从「写得好」前移到「先被翻到」。检索层降价这件事,值得写进下周的优化清单。