引用,而不是名次
在一段生成的回答里,不存在第五名。一个来源要么被用上,要么没有;而这组来源在不同助手之间、在同一提示词的不同次运行之间都会变。把任何单独一次回答当作一个样本,绝不要当成一个名次。
这打断了经典排名跟踪养成的习惯。名次是一个稳定的数字,你可以看着它移动;引用则是一个真有方差的过程给出的二元结果。同一个提示词,隔一小时问两遍,在你的页面什么都没改的情况下,也可能给出不同的来源。
| 经典搜索 | 生成的回答 |
|---|---|
| 有先后的结果列表 | 一组来源,没有先后 |
| 名次稳定到可以跟踪 | 被不被收进去,每次运行都会变 |
| 每个查询一份排名 | 每个助手一份不同的回答 |
| 结果是点击 | 结果是被引用 |
什么样的页面值得被引
靠检索来作答的助手很看重一个页面的开头,所以第一段应该正面回答问题,而不是往问题那儿铺垫。一段花三句话铺陈背景才切入正题的引言,等于递给模型三句没有任何可引之处的话。
具体、可归因的说法能挺过摘要;含糊的定位辞令挺不过。「站点地图每个文件可容纳 5 万个网址」可以原封不动地被抬进一段回答。「我们提供业界领先的站点地图解决方案」哪儿也抬不进去,因为它没有主张任何读者能去核对的东西。
- 先给出答案,再来解释。解释是给留下来的人看的;答案是给所有人的。
- 凡是真实的数字、上限和日期,就把它们点出来。那正是模型能不走样地带走的部分。
- 让每一句主张足够独立,离开它所在的段落也仍然说得通。
- 来自别处的东西要注明出处,这样你的页面才是一个能用的来源,而不是一段没有依据的回声。
不同的产品可以使用不同的爬虫
不同的产品可以使用不同的爬虫。对于 Google 的 AI 概述和搜索中的 AI 模式,Googlebot 是重要的爬虫:Google 表示 Googlebot 的 robots.txt 指令控制搜索访问。 Google-Extended 适用于其他一些 Google AI 用途,而不是页面是否可以出现在 Google AI 搜索功能中。
其他助手可能会公布独立的 user-agent 和控制方式,因此应依据各平台的最新官方文档分别检查,而不是假设一个通用的“AI crawler”规则适用于所有系统。
- 按 robots.txt 现在的样子去读它,而不是按你记忆里写下的样子。
- 对于 Google 搜索,请确认 Googlebot 可以获取您希望符合 AI 功能资格的页面。
- 对于第三方助手,应分别检查其官方公布的 user-agent 和控制方式。
- 仔细决定您希望哪些非搜索爬虫获取您的内容 - 这是业务决策,而不是技术默认。
- 任何基础设施变更之后都重查一遍;CDN 规则和机器人过滤会挡掉 robots.txt 已经放行的代理。
度量一件噪声这么大的事
方差才是这里的核心度量难题,而答案跟任何面对噪声信号的场合都一样:能固定的全部固定下来,反复做,然后拿可比的去比可比的。
- 写一组固定的提示词,代表你真正希望被引用的那些事。
- 按固定的节奏、在同样的助手里跑它们,两次运行之间不改写措辞。
- 记录哪些来源被引用了,而不只是记你在不在里面。
- 拿多次运行互相比较,而不是去读其中某一次。
- 页面上每次只改一件事,然后等满一个周期再下判断。
记录竞争对手的引用,在这里比在经典跟踪里更值钱,因为那一组来源本身就是发现。知道你的主题下有三个具体站点被引用而你没有,等于知道了模型在那儿把什么当作好来源——这比只盯着自己的缺席可操作得多。
GEO 和 SEO 不再有区别的地方
对于谷歌的人工智能功能,差距比词汇表所暗示的要窄:谷歌表示,相同的基本搜索引擎优化实践仍然相关,人工智能概述或人工智能模式不需要额外的技术要求或特殊模式。
其他助手可以使用不同的爬虫、索引和检索系统,因此 GEO 不应假设一种实施模型适用于所有地方。实际的重叠仍然很强:使有用的内容易于获取、易于发现、足够具体以支持答案,并将引用作为单独的结果进行衡量。