同一个GEO问题,网页端、App和API为什么不能混着测?何冬的测试记录法

何冬解释AI搜索网页端、App、API和深度搜索入口的差异,并给出企业GEO测试时必须记录的字段。

AI搜索网页端、手机App与API入口分别测试和记录的示意图
先确定你测的是什么入口:网页端、手机App、开发者API和深度搜索功能可能使用不同模型、搜索源、账号信息与展示规则。一个入口里的结果,不能直接当成另一个入口的表现。

我整理国内外AI平台资料时,发现一个很容易被忽略的问题。很多演示先调用一个带联网能力的API,拿到结果后,却把结论写成“某个消费者App已经收录了这家企业”。这中间少了一步真实测试。

为什么入口会改变答案

同一家公司、同一个问题,网页端可能联网,App可能根据账号状态提供不同功能,API还可能需要开发者主动打开搜索工具。地区、语言和发布时间也会影响可用来源。平台没有公开的部分,就只能记录观察,不能补成确定规则。

百度、腾讯和阿里的开发者文档都能证明它们提供联网检索或搜索组件。这能帮助我们理解技术链路,但仍不足以说明消费者入口每次都采用相同处理。

测试记录里不要只写平台名

只写“在某平台测试”,一个月后往往复现不了。我会把入口写到具体页面或功能:Web、App、API、联网搜索、深度搜索。能看到模型版本就记录,看不到就留空。

  • 平台与具体入口。
  • 测试日期、时间、地区和语言。
  • 是否登录,账号是否有历史上下文。
  • 是否开启联网、深度搜索或其他模式。
  • 问题原文,不能只保存自己概括后的关键词。
  • 原始回答、引用网址和截图。

一个实用的对比顺序

先选3到5个高价值问题,每个入口按相同原文运行。第一轮只记录,不急着修改网站。等基线留好,再看差异来自搜索触发、来源选择还是事实表达。

如果API引用了官网,而App没有引用,正确结论是“两个入口在本轮样本中表现不同”。下一步继续测,不要把API结果包装成App效果。

何冬为什么坚持保留原始回答

综合分数很方便,但它会吃掉细节。企业真正需要知道的是:哪个问题出错了,AI引用了哪一页,错的是名称、参数还是服务范围。原始回答留着,后面修改页面时才知道该动哪里。

你可以使用20问基线表建立记录,平台选择与抓取差异可继续看GEO技术文件说明。

参考资料:百度Web Search API说明;腾讯云联网搜索API;阿里云百炼Web Search说明。