把已约定的问题组与市场作为分母,保存前后两期原始回答;分别计算品牌提及、准确型号、官网引用和实际访问。查看客户授权的询盘数据时保留归因不确定性。交付是否完成可验收,平台答案是否变化只能如实报告,不能用单次截图代替趋势。
先决定到底在衡量什么
“被 AI 看见”至少有四种观察:品牌名称出现在文字里;正确产品用于合适的购买场景;某个网址被列为证据;点击后来到网站并产生业务行为。它们不能相互替代。产品页被引用但回答没有推荐品牌,或品牌被推荐但落到过时零售页,都可能发生。把这些合成一个不披露权重的“AI 得分”,采购方难以判断该改什么。
记录表的基本列包括问题编号与英文原文、目的、平台、目标国家、日期、重复轮次、原始回答保存位置、品牌和型号、被引用完整 URL、事实是否准确、备注。观察前确定品牌名称的同义写法和型号判定规则。平台问答可能不稳定,必要时重复记录并报告差异;不能只保留最有利的一次。
一个明确标注为演示的计算
假设事先确认二十条购买问题,每条在某平台观察一次:五条回答提到品牌,其中三条型号正确,两条出现指向品牌官网的链接。报告应写“本问题组的 20 次观察中,品牌提及 5 次,正确型号 3 次,官网链接 2 次”,并附原始行号与日期;不要直接写“ChatGPT 推荐率 25%,行业第一”。如果一个问题重复三次,分母、次数和汇总规则要事先约定,不能把重复结果与独立问题数混算。以上数值纯属计算示例,不是我们的客户案例。
网站访问与询盘证据的边界
OpenAI 的出版者说明指出,ChatGPT 搜索跳转链接会带 utm_source=chatgpt.com,可在分析工具中查看相关访问。它只能反映可识别的点击,不能覆盖用户读完回答却没有点击、跨设备后直接来访或未出现标记的路径。询盘表可以询问“从哪里听说我们”,但客户自报与分析平台口径会有差异。报告里把 AI 回答观察、AI 来源访问、有效询盘并列呈现,不应把三者强行归为单篇文章的效果。
如何防止对照组被无意中改掉
复测问题组要和基线保持一致,同时另建“新增问题”清单。否则第一期测十条广泛问法,第二期只测十条包含品牌名的问法,提及比例必然提高,却不能反映自然采购场景。若部分问题因产品停售或政策变化失去意义,保留原问题并注明排除原因,再计算有效样本,而不是悄悄删除。
跨国市场不能简单汇总。英国二十次观察中出现五次,美国二十次出现一次,合成六次四十条会掩盖市场差别;最好先按市场和产品线报告绝对数,再解释样本范围。访问与询盘也要注明时间窗、是否同期进行了广告投放或新品发布。这些控制仍不能提供严格因果证明,但能避免明显的误读。
合理的验收条款与复盘
项目结束时验收的是:有无按约定完成基线和复测、原始日志是否可导出、产品事实和稿件是否获批、页面变更是否上线、出现的错误是否被标出、下一步建议是否对应具体证据。若服务商声称“增长 300%”,要问分母、绝对次数、平台、国家、问题组是否同一批、期间是否有新品或付费投放。通过复盘能判断方法是否值得继续,而不是预先保证答案结果。
可以从公开诊断报告样本看文件结构,再让候选团队按你的产品给一页空白报表。
参考资料
平台功能和要求会变化。涉及具体执行时,请以这些官方资料的最新版本为准。