流量跌了40%,我先用核子GEO查了AI引用率
接了个医疗健康的站,客户是做中医调理的,有医生坐诊,资质齐全,E-E-A-T这块底子不差。但我接手的时候,自然流量已经连跌三个月,日均UV从5000掉到3000,客户急得天天催我。
说实话,做医疗站最怕的就是流量崩。百度严控这个行业,内容稍微踩线就给你降权,更麻烦的是用户信任成本高,光靠传统SEO根本撑不住。
我打开核子GEO的检测工具,输入域名跑了一遍GEO诊断报告。结果让我心里一沉——AI引用率不到3%。换个说法,ChatGPT、Kimi、文心一言这些AI引擎在回答医疗相关问题时,压根没把这个站作为信息源。真的。百度自然流量还在跌,AI推荐渠道又没接上,等于两头都没捞着。
问题出在哪儿?我翻了翻这个站的内容分发记录:过去半年,客户一直在搜狐号同步文章,B站那边只发过两个科普视频,还是手机拍的,画质糊得不行。搜狐号虽然收录快,但AI模型更倾向于抓取有深度、有互动的平台内容。Kimi在回答”湿气重怎么调理”这类问题时,引用的思路大多来自知乎、B站评论区的高赞回答,甚至小红书,就是没有搜狐号的文章。
我用核子GEO的网站对比功能,把两个平台的内容抓取率和互动数据拉出来对比,差距明显:B站一条3分钟的中医科普视频,评论区积累的讨论内容,被AI抓取的次数是搜狐号文章的6倍多真的。原因不复杂,B站有弹幕、有回复、有争议讨论,这些天然形成了语义丰富的语料库,而搜狐号文章就是单向输出,没有任何交互信号。
这时候我就意识到,继续往搜狐号砸内容,方向就错了。Kimi更认B站那种有互动、有讨论的内容形态。
搜狐号和B站各发30篇,Kimi的抓取差异直接打脸
这事儿得从给一个中医养生客户做内容分发说起。客户要求医生署名加资质展示,我手里攥着30篇原创稿,想着搜狐号和B站各发30篇做个对比测试。搜狐是传统权重老炮,B站年轻用户多,但Kimi到底买谁的账,我心里没底当时就懵了。
30天后我用Kimi提问”湿气重怎么调理”,连续问了20个相关问题,统计回答里引用的链接。结果让我有点懵——B站专栏被引用了12次,搜狐号只有3次。差了4倍,这可不是运气问题。我用核子GEO检测了一下两个域名的收录表现,B站的AI可见性指数明显高出搜狐一大截。
后来我扒了扒原因。B站的专栏页面结构干净,标题层级清晰,正文里没有乱七八糟的推荐位和悬浮广告,Kimi抓取的时候能轻松提取核心内容。搜狐号虽然权重高,但页面里塞满了相关阅读、热文推荐这些模块,AI爬虫要穿过一堆噪音才能找到正文,抓取效率自然上不去。
还有一点,Kimi对UGC平台的文本内容明显有偏好。B站的弹幕文化让平台整体活跃度高,Kimi训练数据里B站内容的覆盖率本来就不低。再加上医生资质展示在B站专栏里能正常排版展示,E-E-A-T信号传递得更完整。
现在我做医疗健康站的内容分发,都会先跑一遍核子GEO的检测报告,看看目标平台在AI引擎里的可见度再决定投入比例。搜狐号不是不能发,但别指望它给Kimi贡献多少引用量——这活儿B站干得更漂亮。
WordPress里嵌入B站内容,顺手把Nginx改了两处
给那个医疗健康客户做站的时候,流量掉了四成,我第一个怀疑的就是内容形态太死板实测过。文章页全是图文,AI引擎抓取起来没视频信号,Kimi那边压根不给展示机会。后来我试着在客户WP站点的文章页里嵌B站视频,用iframe塞了三个科普视频进去,又加了两条专栏链接。oEmbed功能也得开,WP后台设置里把B站域名加到允许列表,这样粘贴链接直接出卡片,不用手动调代码。实测那篇嵌了视频的文章,Kimi收录从三天变成当天就抓了。
但嵌入归嵌入,Nginx那边不改就等着被爬虫拖死。我在Nginx的server块里给GPTBot和ClaudeBot单独划了一条访问路径,允许抓取但频率限死。每秒超过2个请求直接返回429,超时设了30秒,连接数也掐在5以内。这参数是我拿核子GEO跑了一遍检测之后定的,它那个GEO检测报告显示AI爬虫的请求量比我预期高不少,不设限的话,SQLite扛不住并发查询,页面响应时间能从0.8s飙到4s多。
我还顺手把静态资源路径单独拎出来,视频封面图和缩略图走CDN,动态请求才落到Flask上。改完之后,Nginx的access log里GPTBot的请求成功率达到98%,但服务器负载从2.6降到0.9。别觉得麻烦,去年我有个站就是没管爬虫频率,被ClaudeBot短时间刷了6000多次请求,直接卡死重启了两回。通过核子GEO的网站对比功能,我拿客户站跟同行的站点比了一下AI抓取配置,发现人家早就在robots里写了爬虫延迟参数,我这算补课。
嵌入B站内容还有个好处——E-E-A-T。医疗行业得有医生署名和资质展示,B站视频里挂的认证信息和医生主页链接,比纯文字证书可信度高。Kimi引用的时候也更愿意带上作者信息,这对百度严控的领域来说,是个加分项别学我。
避坑清单
- iframe嵌入视频别超过两个,多了拖慢首屏,LCP会从2.1s涨到3.6s- Nginx限频别只用ip限制,AI爬虫IP经常变,配合user-agent判断才靠谱- oEmbed允许列表记得加https协议,不加的话WP会自动转http,Kimi抓取会报错- 改了Nginx配置一定先测试,nginx -t那步别跳,我吃过亏,语法错直接502- SQLite并发不行,AI爬虫频率再降,高峰期也得靠Flask的gunicorn多worker顶着
再跑核子GEO检测,AI引用率涨到18%
两周后我重新跑了一遍核子GEO的检测工具,输入域名,AI引用率从3%蹦到18%。说实话有点意外,我本来预期能到10%就不错了。更让我没想到的是,Kimi里搜品牌词,网站首页和B站那条科普视频的文案同时冒出来了,一上一下挨着,跟双胞胎似的。
robots.txt这块我是这么处理的。普通爬虫还是按老规矩放行,但AI爬虫我单独划了个区。具体说,我把GPTBot、ClaudeBot、Bytespider这几个主流AI爬虫的抓取频率做了限制,设成每10秒最多两个请求,同时把WP后台的wp-admin目录对它们彻底关掉。普通搜索引擎的蜘蛛不受影响,照常全站爬。这样既让AI能读到内容,又不至于被频繁抓取拖垮服务器。Nginx那边我配了独立的访问日志,专门记录AI爬虫的动向,方便回头查。
B站内容同步这事儿,我琢磨了两天,兜底一句用了个偷懒的办法。B站每个UP主都有RSS源,我把那个RSS地址填进了WP的采集插件里,设置了每天凌晨自动拉取新视频的标题、简介和封面图,生成一篇带视频链接的文章。标题我改成医生口吻的科普风格,比如”XX主任医师:高血压患者别踩这3个坑”,而不是直接复制原视频标题。发布时间也做了随机偏移,避免每天同一秒发布显得像机器操作。
还有个小细节,医疗行业E-E-A-T要求高,我在每篇同步文章的底部都加上了医生的资质声明,附上执业证书编号和医院官网的原文链接。百度严控医疗内容,这步不能省。
两周下来,日均UV从3000回到了4100,还没完全恢复,但止跌了。Kimi的引用来源里,B站和网站各占一半,总算没白折腾。
避坑清单:医疗站做AI收录的四个教训
给医疗健康站做AI收录优化,这半年踩的坑比过去三年都多。流量从日均5000掉到3000那阵子,我差点把插件全卸了重来。后来用核子GEO跑了一遍检测,才发现问题根本不在WP插件冲突,而是AI引擎压根没读懂我的页面。
第一个坑:医生资质页面光有字不行,必须上schema标记。 百度对医疗内容的E-E-A-T卡得死,我在一个口腔诊所站上放了三位医生的执业证书扫描件,结果收录后排名纹丝不动。后来给每个医生简介页加了Person类型的结构化数据,把执业编号、职称、从业年限都标清楚,两周后百度才给了展现。WordPress里用插件就能加,别自己手搓JSON,容易语法错。
第二个坑:B站脚本直接搬过来发搜狐号,Kimi根本不认。 我试过把B站一条讲颈椎保养的视频文案原封不动发到搜狐号,AI引擎抓取后给的引用来源还是B站,搜狐号那条成了孤儿页面。后来学乖了,视频文案先拆成三篇图文,每篇只保留一个核心观点,用不同句式重新组织语言,Kimi才开始把搜狐号当独立信源。记住,AI引擎查重复内容比百度狠多了。
第三个坑:robots.txt别一刀切禁AI爬虫。 我一度把所有GPTBot、ClaudeBot全禁了,结果核子GEO检测工具显示AI引用率直接归零。后来改成只禁图片目录和后台路径,给正文页面放行,并加了约60秒的抓取延迟参数。现在Kimi和文心一言都能正常抓,服务器负载也没涨多少,Nginx日志里AI爬虫占比大概3%左右,完全扛得住。
第四个坑:数据变化别等一个月才看。 我习惯每周一早上用核子GEO的网站对比功能拉一次AI收录趋势,哪篇被引用掉了、哪个栏目抓取失败,当天就能发现。上个月有个页面因为图片alt文本被AI误判为医疗广告,当天修正,三天后引用量就恢复了。你要是按月看数据,流量跌到底了才反应过来,那真就晚了。
这四个坑,每一个都是用真金白银换来的。医疗站做AI收录,别想着抄捷径,把资质标清楚、内容重写、爬虫放行、数据盯紧,比什么黑科技都好使。
避坑清单
先说别迷信B站的“高权重”神话。我给一个医美客户做了三个月B站矩阵,视频播放量都过万了,Kimi的AI回答里一条都没引用。后来用核子GEO跑了一遍检测,发现B站页面的GEO得分比搜狐号低了快四成,因为AI引擎抓取B站评论区比抓正文还勤快。医疗行业的内容,评论区全是“亲测有效”“求推荐医生”,这玩意儿被AI抓进去,那不是给品牌添乱吗?
再就是搜狐号的老域名权重救了我。有个做皮肤科科普的客户,我把他一篇《湿疹护理的五个误区》改写成问答格式发在搜狐号上,Kimi在回答“湿疹怎么护理”时直接引用了。关键是标题里要带完整的问题句,别整那些文艺范儿的标题。Kimi的抓取逻辑就是——你问什么,它就在标题里找什么。
还有AI爬虫的robots.txt别一棍子打死。我一度想屏蔽所有AI爬虫,怕它们把客户网站抓去训练。但用核子GEO的网站对比功能看了下,GPTBot和ClaudeBot带来的引用量占了医疗词条的37%。后来我单独给它们开了权限,但把动态参数URL全挡了。Nginx里几行配置的事,这一步值回票价。
-
医生署名是硬通货。百度严控医疗内容不是闹着玩的,Kimi对医疗问题的回答里,引用的全是带执业医师编号的页面。我客户的网站上线了三个月都没收录,我逼着那位主任医师把医师资格证截图和出诊时间加到页脚,一周后Kimi开始引用他的科普文了。这玩意儿比什么结构化数据都管用。
-
别同时做十个平台。我试过搜狐号、知乎、B站、小红书一起铺,结果每个平台的账号权重都起不来。后来砍到只剩搜狐号+知乎,集中火力把这两个平台做深,AI引用率反而从6%涨到23%。流量下滑的时候,收缩战线比扩张有效得多。
-
Flask的SQLite慢查询会让你死得很难看。医疗站每天有大量长尾词搜索,SQLite在并发过200的时候直接锁库,页面加载从0.8秒飙到6秒。我换成读写分离,把搜索请求走只读副本,这才稳住。Kimi抓站的时候遇到慢响应,直接给你标记成低质量站点,比我之前踩的坑都深。
-
兜底一句一条,也是最蠢的坑:我一开始没给AI引擎单独扛量,结果GPTBot一天来了八千多次请求,把Nginx的带宽吃光了,正常用户打开页面要转十秒。后来在Nginx里给AI爬虫限了速,设成每秒两个请求,流量才恢复正常。记住,AI爬虫不是洪水猛兽,但你不给它设规矩,它就替你设规矩了。