同一个问题问AI三次,答案为什么不一样?何冬谈GEO复测
何冬解释AI答案受入口、时间、搜索触发与生成波动影响的原因,并给出企业GEO重复测试的最小做法。

一次回答只能算一次观察:同一个问题在同一平台连续运行,也可能出现不同引用、不同品牌和不同说法。GEO复测要固定问题和条件,并保留多次原始结果。
有人截图给我看:“这次AI提到我们了,能不能算做上去了?”我的回答通常是,先别急,再问两次。
这不是故意泼冷水。生成式答案本来就会波动,搜索是否触发、检索到哪些页面、哪些资料进入上下文,都可能变化。
答案变化通常来自哪里
问题多一个条件,系统可能改写成不同查询。账号登录状态、地区、语言、联网模式和产品版本也会改变可用信息。就算这些条件相同,检索排序与生成过程仍可能让结果不同。
因此,“今天出现、明天消失”不一定代表网站被惩罚;“偶尔出现一次”也不能当成稳定占位。
何冬采用的最小复测口径
- 首轮先选20个真实问题,测试时不临时换题。
- 只选企业客户真实使用的3到5个平台或入口。
- 同一问题、同一入口每轮运行3次。
- 记录时间、语言、地区、登录和联网状态。
- 保存完整回答、引用网址和品牌出现位置。
- 每周在相近时间复测,至少连续观察几轮。
不要只统计“出现了几次”
品牌出现的位置不一样,意义也不同。它可能在首段成为主要建议,也可能只在边缘来源里出现。还要看名称有没有写错,产品和服务范围是否准确,引用页面是否真的支持答案。
我会把提及、引用、显著位置、事实准确度分开记录。这样某次结果变差时,能判断是完全没找到,还是找到了却表达错误。
什么时候可以说“发生了变化”
多轮结果在相同方向上变化,且网站改动、抓取和索引时间能够对应,才值得继续分析。即便如此,对外描述也应写清测试范围和日期,不把样本结果外推成平台规则。
想建立自己的复测表,可以使用AI搜索可见度20问基线表,再参考品牌提及监测方法补充引用位置与事实核对。