GEO 效果怎么验收?六条能复现的口径,比承诺百分比更值钱
2026-09-09
GEO 服务最容易产生分歧的环节,不是执行,而是验收。
服务商说「已经做到了」,客户说「我自己搜怎么没有」。双方都没有说谎——只是没人把验收口径提前钉死。
一、第一步:先把「环境」固定下来
AI 的答案不是固定不变的。同一句提问,换个设备、换个时段、换个设置,答案都可能不同。所以验收的第一个动作,是确定一套可复现的环境:
- 设备与端:明确用移动端还是网页端(两者收录与排序常不一致)。
- 联网搜索开关:必须开启,且需在验收文档里写清楚。关闭联网时,AI 只凭训练语料作答,结果不可比。
- 深度思考开关:建议明确关闭,减少答案随机性。
- 登录态与地理位置:是否有账号登录、在哪个城市发起,都会影响结果。
- 提问原文:一字不改,标点都算。改一个字,就是另一个问句。
- 取样规则:同一问句连续多天、每天不同时段取样,取分布而不是取单次。
二、六个核心指标,覆盖「有没有」到「值不值」
| 指标 | 定义 | 参考目标 |
|---|---|---|
| 首推率 | 品牌被作为首选或唯一推荐的比例 | ≥ 40% |
| 提及率 | 品牌进入推荐名单的比例 | ≥ 85% |
| 情感倾向 | AI 描述品牌时的正面占比 | 正面 ≥ 90% |
| 声量份额 | 特定品类下品牌被提及的占比 | 争取品类第一 |
| 信源可溯率 | AI 引用内容中可追溯到企业可控信源的比例 | 越高越好,反映资产归属 |
| 线索归因率 | 询盘中能追溯到 AI 渠道的比例 | 先建立基线,再谈增长 |
前四项衡量「有没有被看见」,后两项衡量「这件事是不是真的算你的」。很多项目做了半年只报前四项,交付一旦停止,效果就跟着消失——原因往往是没有做信源归属。
三、别用「截图」当验收材料
单张截图可以挑、可以重试,也可以只截好的一天。真正有说服力的是稳定命中率:同一个问句连续 7 天、每天 3 个时段,命中多少次。把这份分布表放进月报,比十张漂亮的截图都硬。
四、建议写进合同的四句话
- 验收问句清单(含数量与原文),作为合同附件。
- 监测平台与各平台权重,权重如何加权计算总达标率。
- 达标定义与结算方式:是全部达标才算,还是按比例结算?不达标如何处理?
- 算法变更条款:当平台规则调整导致无法按原方案执行时的处理方式。
五、一个提醒
「效果对赌」听起来很美,但关键在于——达标的定义权在谁手里。如果验收问句挑的都是好做的长尾词,达标率自然漂亮。建议客户自己掌握问句清单的最终确认权,尤其是品类问句和对比问句。
验收口径的价值,不在于让服务商难做,而在于让双方在三个月后,还能指着同一份标准说话。