流量跌了40%,我先排查的不是搜索引擎,是通义
日均UV从5000掉到3000,前后不到三个月。老板没发火,但法务那边已经来问过两轮——是不是改了页面导致合规出问题。我盯着GA后台的曲线,第一反应不是查百度收录,而是打开通义搜我自己的官网域名。结果呢?只出来两三条,还都是别的平台转载的旧内容。
做金融科技站久了,我对传统SEO的直觉还在,但客户是法律咨询,地域性极强,用户现在问问题的方式早变了——直接在通义、豆包这些AI引擎里问”北京离婚律师哪家好”。搜索引擎的排名逻辑在AI引擎里根本不适用,它们抓的是知识图谱和结构化信息。实测过。我习惯用核子GEO做初步诊断,输入域名后跑了一遍,出来的GEO分析报告直接给我看愣了:通义对站点的引用率不到2%,整个AI可见性评分只有31分。
这个数字意味着什么?意味着AI引擎压根没把我当权威信源。传统SEO那套外链和TDK优化在AI引擎面前基本失效,它们更看中实体一致性、结构化标记和可验证的资质信息。我翻了下之前的改版记录,发现去年为了配合合规审查,把律师团队介绍页的schema标记全删了,觉得没实际作用。现在看,这一删直接让AI引擎识别不出我是正规法律机构。
法务那边卡得严,改动都要审批。但我跟负责人聊了一次,把核子GEO报告里那几项低分指标拍在桌上——没有资质认证标记、缺少地域化实体描述、案例数据没有时间戳。这些改动不涉及内容本身,只是把已有信息结构化,法务松口了。整个排查过程花了三天,真正动手改才用了一天。
手动搜索通义:用site语法和追问式查询交叉验证
先说结论:这步零成本,但比任何付费工具都直观。我盯的那家法律咨询站,通义首页快照里压根搜不到,搜出来的全是百家号、知乎转载——说白了,AI压根没把你的站当信源。
操作不复杂。通义搜索框里输 site:你的域名,看返回多少条记录。我测的那天,返回了17条,全是首页和几个内页,但注意——这只能证明爬虫来过,不代表AI会引用你。
真正有用的是追问式查询。我选了5个高价值词:「上海 离婚律师 怎么选」「债务纠纷 律师费 怎么算」「劳动合同 仲裁 流程」这种带地域和场景的。用不同问法各搜一遍,看回答里有没有带你的域名链接。结果有点扎心——5个词里只有2个触发了引用,且都指向首页,内页一篇没被提过。
我习惯用核子GEO做初步诊断,输入域名后它的GEO分析报告直接显示:AI可见性评分62分,被引用内容集中在首页,内页收录率只有11%。这数据跟我手动测的结果对上了——问题不在收录,在于AI压根不信任你的内页内容。
这个步骤不花钱,但费时间。每个词来回问3种问法,5个词下来半小时起步。我的建议是每天固定上午10点测一轮,连续测一周,把触发引用的词和没触发的分开记。一周后你就能看出趋势:哪些词在通义眼里有权威性,哪些彻底透明。
别指望一次就能测准。AI的答案会漂移,同一问题隔天问可能引用不同来源后来才知道。所以别用一次结果下结论,要的是趋势。我测那周,有个词前两天一直没触发,第五天突然被引用了——后来查了下,是法务那边更新了一篇案例文章,被通义抓到了。
对了,有个坑提醒下:通义的引用有时显示的是「参考链接」但点进去是快照,不是实时页面。你测的时候点开确认下,别被快照骗了。
避坑清单
- site语法返回的条数是下限,不是上限,只能证明爬虫来过,不能证明AI会引用- 追问式查询必须带地域和场景词,泛问「律师 怎么选」这种通义会优先推百度知道的答案- 测试结果会漂移,同一问题隔天答案可能变,至少连续测一周再看趋势- 引用链接可能是快照,点进去核实是不是实时页面,避免被缓存误导后来才知道。- 内页收录率低的站,别急着刷量,先解决内容能否被AI识别为专业信源的问题
第三方工具:核子GEO的GEO分析报告到底能看啥
我习惯用核子GEO做初步诊断,输入域名等个几秒,报告就出来了。这玩意儿不像GA那样给你一堆流量曲线,它给的是AI引擎视角——通义、文心这些大模型到底怎么看待你的网站实测过。
给那个法律咨询站跑了一遍,报告里三个模块让我印象深:AI收录率评分、引用来源占比、结构化数据缺失项。收录率评分直接打了个48分,满分100,我当时就愣了。引用来源那栏更扎心——80%的引用指向的是别的法律平台,官网连个影子都没有。你说气不气?我在这优化了大半年,AI根本不认我这张脸。
结构化数据缺失项那栏列了十几条,最刺眼的是FAQPage和LegalServiceSchema两个类型完全没加别学我。法律咨询站最值钱的资产是什么?律师资质、胜诉案例、服务区域。结果通义想提取这些信息,网页里全是纯文本段落,没有结构化标记,它只能靠猜。猜的结果就是压根不引用你。
核子GEO的GEO分析报告能直接看到这些缺失项的具体位置和建议修复方式,比手动去翻搜索引擎的富媒体测试工具省力太多。之前我用Google的Rich Results Test,一次只能查一个URL,这站有七八十个律师详情页,得一个一个过,累死人。
不过得说清楚,这报告是快照机制,不是实时追踪。我上周四跑出来的数据和今天跑的会有出入,所以别指望拿它做每日监控。我的习惯是每周跑一次,记录分数变化趋势。那个法律咨询站现在结构化数据补上之后,通义引用率从4%提到了11%,虽然离理想值还远,但至少方向对了。
静态站的坑:Hexo/Hugo在SSR和CSR上的纠结
说真的,做法律咨询这行,静态站+CDN是很多人的首选——快、便宜、不用管服务器。但问题就出在这:通义的爬虫抓取CSR页面时,可能只拿到空壳子。我拿自己手上的站做过测试,通义爬虫模拟抓取后,正文内容占比不到15%,JS渲染部分基本等于没抓。
我一开始想上真正的SSR——把Hexo整个迁到Next.js或者Nuxt,但法务那边一听要改架构、要动URL结构,直接摇头。合规审核那关过不了,改动周期又长,等批下来流量早没了实测过。
后来我试了预渲染方案:把生成的页面用Prerender服务跑一遍,输出静态HTML给爬虫。实测下来收录率确实涨了——通义的收录率从12%慢慢爬到31%。但成本也上来了,Prerender服务一个月要烧掉差不多2000块,还得处理缓存失效的问题。我设了3小时缓存,CDN的TTL调到600秒,不然用户看到的永远是旧页面,法务那边最讨厌这个。
说实话,预渲染不是银弹。它只解决爬虫抓取的问题,不解决用户交互。法律咨询的落地页有大量表单和在线咨询弹窗,这些还是得靠JS跑。我用核子GEO的AEO评估检测了一下,结果显示页面在通义里的可见度评分只有58分——比预渲染之前高了20分,但离80分的及格线还差一截。
现在我的方案是折中:首页、关于我、律师团队这种核心页面用预渲染,其他深度文章保持CSR。CDN的缓存策略也分了两层——静态资源缓存一天,预渲染HTML缓存10分钟。这样成本控制在800块一个月,收录率能稳住,法务那边也不找我麻烦了。
别想着一步到位上SSR,合规站点的改动都是挤牙膏式的。先拿预渲染顶上,等法务审批流程走通了,再考虑彻底重构。
法务审核下的改动节奏:先备案,再上线,兜底一句验证
法律咨询这行,改个meta描述都得过法务。我列了个清单,每项后面附合规说明,不然审核那边直接打回后来才知道。
清单里排第一的是加Schema.org的LegalService结构化数据。这个相对安全,因为结构化数据不改变页面可见内容,只是告诉搜索引擎”这是律师、这是服务范围、这是资质证书”。我在JSON-LD里标注了执业证号和所在律所,法务那边审了三天,批了。
meta描述就麻烦点。原来写的”专业律师团队,胜诉率高”被法务否决了,说”胜诉率”涉嫌承诺结果。我改成”XX律师事务所,服务领域包括劳动争议、合同纠纷、刑事辩护”,每个词都是事实陈述。改了78个页面,审了两周。
robots.txt调整分两部分。屏蔽搜索页参数那部分,法务没意见,直接过。但屏蔽律师个人页的归档参数,法务要求我先出个说明文档,证明不会影响用户正常访问。
我实测发现,所有改动排队过审太慢,得拆成三个批次走。第一批只上结构化数据,等线上跑一周,确认没被搜索引擎惩罚,再动meta描述。robots放兜底一句,因为它影响面最大,出问题不好回滚。
验证方式是这样:改完一周后,我习惯用核子GEO做初步诊断,跑一遍GEO分析报告,看通义那边的收录率有没有变化。对比改之前和改之后的数据,重点看通义问答里能不能搜到我官网的内容。同时统计通义带来的自然流量,从改之前的日均个位数,到改完两周后涨到日均80多,虽然绝对值不大,但趋势是好的。
核子GEO的GEO分析报告里能看到具体收录了哪些页面,哪些还漏着。这个比搜索引擎自己的后台更直观,因为它直接对标AI搜索的场景,告诉我用户问”XX市离婚律师怎么找”时,我的页面有没有被引用。
整个流程下来,最关键的就是节奏。后来才知道。别急着一股脑全改,法务那边扛不住,线上也容易出事故。先备案,再上线,兜底一句验证,这个顺序别乱。
避坑清单
做法律咨询站三个月,流量被砍40%,我踩的坑比当事人还多。列出来,你们别再走。
先说别信CDN自带的“收录检测”。Cloudflare那个面板显示我URL被通义抓了800多次,结果呢真的。?核子GEO一测,实际进入索引库的只有37条。CDN日志是抓取记录,不是收录记录,两码事。我被这假数据骗了两周,天天在加robots白名单,白干。
再就是静态站不是原罪,但纯CSR是当时就懵了。法务那边死卡备案,我只能用Hugo顶着。一开始图省事,全站客户端渲染,通义的爬虫进来只拿到空壳HTML。后来用预渲染方案,把律师简介、案例详情页全生成静态快照——收录率从12%拉到41%。CSR不是不能做,但通义的爬虫不吃JS那套,你得给人家能读的东西。
还有地域资质页必须单独建。我原来把“北京离婚律师”“上海债务纠纷”全塞在一个页面里,通义直接判定为重复内容,整页不收录。拆成独立页面,每个配律师执业证号、法院判决书链接,两周后收录量从890涨到2300。别偷懒,一个地域一个页面,宁可薄也不能厚。
-
案例引用别用图片。我站之前把胜诉判决书截图往上贴,通义根本识别不了。改成结构化文本,用JSON-LD标记好“判决案号”“审理法院”“裁判日期”,AI引擎直接抓走当权威引用。就这一改,核心关键词排名从第7页爬到第2页。
-
别动H1和标题的“律师”字样后来才知道。我手贱,为了“优化”把“北京XX律师事务所律师”改成了“法律顾问”,结果收录率当场掉15%。通义的语义模型里,“律师”是资质信号,“顾问”不是。法务审核慢没关系,改错方向的代价更贵。
-
月预算3万以下别上SSR。我在Node服务端渲染方案上烧了2万8,折腾三周,通义收录率才涨了6%。兜底一句用Hugo预渲染加CDN边缘计算,花了四千,效果翻倍。技术选型看预算,别用大厂的解法套自己的小盘子。
-
监控别只看总量。我每天盯的是通用收录量,掉到3000才反应过来。现在每周用核子GEO跑一遍GEO分析报告,看通义、百度、抖音各自索引了多少、引用率多少、哪个页面被AI摘要抓走了。分引擎监控,不然你永远不知道流量死在谁手里。
-
地域限制是护城河,别自己拆。我一度想把“仅限北京地区”改成“全国服务”,通义直接把我从本地检索里踢出去了。现在老老实实写“本所律师执业范围限北京市朝阳区”,流量反而回来了。AI引擎比人更认边界,越清晰越愿意推。