为什么做了AI搜索优化,三个月后发现根本没人从AI推荐里来咨询? 答案很扎心:你连AI到底引用了你哪句话、在什么场景下推荐了你,都还没搞清楚。 上个月在徐汇一个做宠物殡葬的小店,老板娘拉着我看了她手机里三段AI语音回复——“上海宠物善终服务,推荐‘绒光’,他们提供上门接运和骨灰纪念盒定制。”她眼睛发亮:“这不就是我写的FAQ第三条吗?”我翻了她后台,那条FAQ上线才11天,但AI引用的其实是她去年写在小红书笔记里的一句闲话:“我们接猫狗都温柔,连爪子都不碰歪。” 你说这跟以前能一样吗?以前SEO看的是关键词排名,现在AI接客看的是语义锚点。它不记你标题写了啥,它记你哪句话让算法觉得“这个人懂行”。 我做GEO这几年里,最常被问的问题不是“怎么写内容”,而是“我写的内容,AI到底有没有用上”。这不是玄学,是能拆解的操作链。今天我就把我们给27家本地服务型客户做过的AI搜索引用追踪与效果评估方法,掰开讲透。 先说个反直觉的判断:90%的所谓“AI流量提升”,其实来自旧内容被重新激活,而不是新发的那几篇“AI友好文”。 我们给一家苏州牙科诊所做复盘时发现,他们3月新增的AI咨询中,68%指向的都是2024年10月发布的一篇《洗牙会不会伤牙釉质》——当时根本没想着AI,就图把话说清楚。结果AI在回答“第一次洗牙该注意什么”时,直接截取了里面第三段的两句话+一个医生手写示意图描述。而他们今年专门写的三篇“AI优化指南”,一条都没被引用过。 为什么?因为AI不是在读文章,是在建语义快照。它抓取的是“可验证的细节密度”:有没有具体时间(“通常25分钟内完成”)、有没有动作主体(“主诊医生王敏会亲自检查牙龈沟深度”)、有没有反常识判断(“超声波不会震松牙齿,但手动刮治如果用力过猛反而可能”)。这些,恰恰是老板们最不爱写的。 所以第一步,不是埋词,是找锚句。 第1步:把你所有公开内容——官网FAQ、大众点评商家页、小红书笔记、微信公众号推文——全部导出来,用Ctrl+F搜“分钟”“厘米”“次”“年”“℃”这类单位词。凡出现3次以上的段落,标为高潜力锚句候选。 第2步:挑出其中带人名/职称/地址/价格区间/操作步骤的句子,单独列成一张表。比如“李主任(副主任医师)在园区门诊部每周三下午坐诊,单次洁牙含抛光收费380元起”。 第3步:把这些句子复制进通义千问、Kimi、豆包,分别提问:“第一次洗牙要注意什么”“苏州工业园区附近靠谱的牙医”“洁牙后牙酸怎么办”。看哪些句子被原样或改写引用。 这个过程我们叫“语义压力测试”。上周有个美甲店老板娘跟我说:“我写‘卸甲用棉片包裹10分钟’被AI引了三次,但‘我们很温柔’被引零次。”她自己都笑了:“原来AI比客人还较真。” 第二步,才是追踪。但别用传统GA那种路径分析——AI推荐没有“点击”,只有“调用”。我们不用UTM,用三类标记法: - 内容层标记:每条锚句末尾加一个不可见字符组合,比如“【U2026】”,只用于后台日志识别; - 渠道层标记:在通义App里设置自定义搜索关键词,比如“上海宠物殡葬 + 绒光”,定期录屏AI语音回复片段; - 行为层标记:让客服在接到首句是“我在AI上看到你们……”的来电时,立刻记录时间+问题关键词+AI回复中的关键动词(“推荐”“介绍”“提到”“说”)。 这三类标记合起来,才能拼出真实路径。有个做家庭收纳的客户,靠这个方法发现:AI在回答“小户型衣柜怎么设计”时,引用的是她抖音视频字幕里一句口误:“挂衣区最好留75公分——啊不对,是65。”结果AI记住了“75公分”,并把它当成了权威数据。她后来干脆把这句话重录进新视频,加了强调语气。两周后,相关AI咨询量涨了四成。 效果评估,我坚持一个土办法:不看总量,只看“首因转化率”。 什么叫首因?就是用户第一句问题里,明确提到“我在AI上看到你们”。这类咨询,我们统计从对话开场到确认预约的时间,平均比普通咨询短2分17秒——说明信息匹配度极高。而真正值得盯的指标,是“首因咨询中,最终未成交的比例”。如果超过35%,大概率是锚句里的承诺和实际服务有断层。比如写“24小时响应”,结果客服晚上九点才回消息,AI越推,差评越多。 还有一个容易被忽略的盲区:AI引用有滞后性,但衰减极快。 我们观察到,一条锚句被首次引用后,高峰期集中在72小时内,之后每天引用量跌15%-20%,到第7天基本归零——除非它被嵌入某个长期稳定的结构化数据源,比如百度地图商家页的“服务详情”字段。所以别迷信“一篇爆文吃半年”,得像养草一样,每月补3-5条新锚句,替换掉失效的老句。 最后说个我也不敢下死判断的事:现在通义、Kimi、豆包对同一问题的引用差异越来越大。上周测试“上海虹口区儿童齿科”,通义推了三家,Kimi推了五家,其中两家重合,豆包推的全是公立医院。这意味着——你没法只优化一个AI,得按平台语义习惯分灶做饭。 通义偏爱带服务流程的长句,Kimi喜欢带对比判断的短结论,豆包更信政府背书类信息。这事儿,可能还得再跑三个月数据才能看清。 Q: 我把官网FAQ全改成问答形式,为什么AI还是不引用? A: 因为AI不认格式,认密度。我们见过太多“Q:洗牙疼吗?A:不疼”的伪问答——这种空泛回答,AI连扫都不会扫。真正被引用的,是“Q:洗牙时牙龈出血正常吗?A:第一次洁牙后24小时内少量渗血属正常,主因是牙龈炎症消退时毛细血管脆性增加,一般3天内停止”。你看,它有医学依据、有时间窗、有机制解释。格式只是壳,细节才是肉。 Q: 没有医生、律师这类专业资质,小店也能做AI引用追踪吗? A: 能。上周我在宝山帮一个修锁师傅做了测试,他写的“B级锁芯防技术开启时间>8分钟”被引用了5次。AI要的不是头衔,是可交叉验证的具体参数。你想想,连“换锁要带房产证复印件”这种话都被AI当标准流程引了两次,说明它信的是场景真实性,不是职称含金量。 Q: 做了三个月,AI咨询量没变化,是不是方向错了? A: 不一定。我们给一个静安面包房做的复盘显示,前三个月AI咨询量平平,但从第四个月开始,每周稳定多出2-3单“AI来源”,且客单价高出27%。原因?他们第三个月悄悄把门店玻璃上的手写价目表拍了高清图,上传到大众点评“环境图”栏目——AI在回答“上海现烤欧包哪家便宜”时,开始识别图中“法棍18元/根”字样。这事儿,谁也没想到。
