有一种情况值得单独说:站点在 Google 里收录正常、排名也不差,但在 AI 回答里几乎从不出现。内容、外链、更新频率都查过,没问题。这种时候大概率不是权重问题,而是AI 根本没读到你的正文。

关键事实:AI 抓取程序不跑 JavaScript

Vercel 的抓取分析里,GPTBot 只在 11.5% 的请求里抓取过 JavaScript 文件,ClaudeBot 是 23.84%,而且都不执行脚本。对比之下,Googlebot 会渲染页面。结论很直接:纯靠前端渲染出来的正文、内部链接、价格和参数,对相当一部分 AI 抓取程序等于不存在。同一份分析给出的估计是,约 42% 的 JavaScript 渲染内容没有被 AI 体系纳管。

三个自查动作

  • 在原始源码里搜正文:抓一下页面源码,搜一句只在正文里出现过的话,搜不到,说明正文是渲染出来的;
  • 关掉 JavaScript 再看页面:浏览器禁用脚本后打开关键页,如果只剩导航和加载动画,AI 看到的是同一幅画面;
  • 查内部链接是不是真链接:写在脚本事件里的跳转,抓取程序跟不下去,它们只认 HTML 里的链接标签。

还有四个容易忽略的地方

  1. 允许抓取,但被挡在门外:机器人协议里放行了 AI 抓取程序,可 CDN、防火墙或安全插件默认拦截,两边规则打架,结果就是「协议上欢迎、实际上进不来」,这类问题在日志里表现为大量拒绝或超时;
  2. 正文在图片里:把核心参数做成图片,人能看、机器读不出文字,等于没写;
  3. 分页与折叠:内容藏在「点击展开更多」之后,抓取程序不会去点;
  4. 同一页面多版本:带参数的地址被当成另一个页面,正文被拆散,抓到的每一份都不完整。

修复顺序

  1. 服务端渲染或预渲染正文页,至少让产品、方案、常见问题、文章这四类页面先落地;
  2. 关键事实直接写在 HTML 文本里:价格、参数、交付范围不要只放在图片、图表或组件里;
  3. 站内导航用真实链接,别用纯脚本织出来的菜单;
  4. 改完用同一个命令复验,确认源码里能搜到正文句子。

总结:AI 可见度的地基是「能被读到」。这一步不过关,后面的内容打磨和权威建设都是白做工。