同一个GEO问题,网页端、App和API为什么不能混着测?何冬的测试记录法
何冬解释AI搜索网页端、App、API和深度搜索入口的差异,并给出企业GEO测试时必须记录的字段。

先确定你测的是什么入口:网页端、手机App、开发者API和深度搜索功能可能使用不同模型、搜索源、账号信息与展示规则。一个入口里的结果,不能直接当成另一个入口的表现。
我整理国内外AI平台资料时,发现一个很容易被忽略的问题。很多演示先调用一个带联网能力的API,拿到结果后,却把结论写成“某个消费者App已经收录了这家企业”。这中间少了一步真实测试。
为什么入口会改变答案
同一家公司、同一个问题,网页端可能联网,App可能根据账号状态提供不同功能,API还可能需要开发者主动打开搜索工具。地区、语言和发布时间也会影响可用来源。平台没有公开的部分,就只能记录观察,不能补成确定规则。
百度、腾讯和阿里的开发者文档都能证明它们提供联网检索或搜索组件。这能帮助我们理解技术链路,但仍不足以说明消费者入口每次都采用相同处理。
测试记录里不要只写平台名
只写“在某平台测试”,一个月后往往复现不了。我会把入口写到具体页面或功能:Web、App、API、联网搜索、深度搜索。能看到模型版本就记录,看不到就留空。
- 平台与具体入口。
- 测试日期、时间、地区和语言。
- 是否登录,账号是否有历史上下文。
- 是否开启联网、深度搜索或其他模式。
- 问题原文,不能只保存自己概括后的关键词。
- 原始回答、引用网址和截图。
一个实用的对比顺序
先选3到5个高价值问题,每个入口按相同原文运行。第一轮只记录,不急着修改网站。等基线留好,再看差异来自搜索触发、来源选择还是事实表达。
如果API引用了官网,而App没有引用,正确结论是“两个入口在本轮样本中表现不同”。下一步继续测,不要把API结果包装成App效果。
何冬为什么坚持保留原始回答
综合分数很方便,但它会吃掉细节。企业真正需要知道的是:哪个问题出错了,AI引用了哪一页,错的是名称、参数还是服务范围。原始回答留着,后面修改页面时才知道该动哪里。