做 GEO 的人盯报表,盯的多半是「用户打了什么字」。但用户的提问方式早就多了一种:对着商品拍一张照、在屏幕上圈一圈、右键搜一张图。9 月 24 日,Google 给 Search Console 加了一个新筛选器——「网页:多模态」,而且同步进了生成式 AI 效果报表。这件事的分量在于:图片发起的搜索,从此有了自己的账本,也正式算进了 AI 曝光的口径里。
先搞清楚它统计什么
按 Google 官方公告,这次计入「多模态」的入口有四个:Google Lens、安卓的圈选即搜、往搜索框直接传图,以及 Chrome 右键的「搜此图片」。共同点很明显:用户没有打字,图片本身就是问题。
筛选器同时出现在两个地方:常规的搜索效果报告,和统计 AI Overviews、AI Mode 曝光的生成式 AI 效果报告。全球推送,9 月 24 日当天生效。如果站点没有这类流量,筛选行会是空的——这不是 bug,而是一个信号:你的页面还没从「视觉入口」被找到过。
为什么这事和 GEO 有关
过去,多模态流量混在「网页」总数里,你看不出一个页面是靠文字还是靠图被找到的。现在两条线分开了,尤其在生成式 AI 报表里——图片触发的搜索同样会带出 AI 答案,你的页面可能就引用在里面。
这等于给视觉资产补上了缺了很久的度量:一张产品图、一张场景图,如果用户拍下它就能触发带着你链接的 AI 回答,那图片就不再是排版装饰,而是内容资产。哪张图在干活、哪些页面只靠文字撑着,报表第一次能分开说清楚。
30 分钟自查怎么做
- 在两个报表里分别导出「多模态」与「文字」两组数据,找出只在图片侧有曝光的页面——它们在视觉这件事上做对了;反过来只在文字侧有曝光的页面,可能是本该用图回答的问题却没配图。
- 打开图片侧表现最好的几页,问三个问题:这张图能独立回答用户的问题吗?文件名是描述性的,还是 IMG_4471 这种?alt 文本在描述画面内容,还是在复读标题?
- 记账时留意四个限制:多模态搜索基本没有查询词,查询维度不可用,只能看页面级数据;AI 报表只记展示,别当流量预测;它不等于 Google 图片频道那一栏;Search Labs 的实验数据不计入。报表导出可用,但 Search Analytics API 暂时还没有对应的类型参数。
用户的提问正在从打字变成拍照、圈选。GEO 做的是「被 AI 找到」,而图片就是问题的另一种问法——以前测不到,现在有数了,值得每周看一眼。