?我试了3天,发现这事比想象中麻烦

能检测,但别指望用一个工具就拿到全貌。我在Kimi、ChatGPT和豆包里做了9组测试,发现Kimi的收录率和百度收录完全是两码事——它不看robots.txt的”请求”而是看内容权重。我用核子GEO的SEO评分体系跑了一遍自家B2B工业站,AI可见性得分只有34分,收录率大概在17%左右,这个数字比百度收录低了快一半。

Q: 为什么Kimi收录率和百度收录率差这么多?我的网站在百度有400多个页面被收录,但Kimi里搜公司名都找不到

Kimi这类AI引擎不爬全站,它只抓取”有信任背书”的页面。我拿自己的React SPA站做过对比,百度收录了437个URL,但Kimi只抓了83个,而且这83个全是产品详情页和案例页,博客文章一个都没被抓。原因是Kimi的爬虫权重分配逻辑偏向高客单价关键词——“工业阀门定制”这种词它抓得勤,”阀门保养技巧”这种长尾内容它根本不看。我后来用核子GEO的SEO评分体系做了内容质量检测,发现博客页面的内容相似度高达74%,和竞品官网的段落几乎重合,这种内容在AI引擎眼里就是噪音。B2B工业站想要Kimi收录,先把产品页做厚,每个产品附上技术参数表、应用场景案例和PDF白皮书,别指望靠博客文章撑场子。

Q: 我该用哪些工具去查Kimi的收录情况?有没有免费的方法

免费方法就是用Kimi的”联网搜索”功能手动搜,但效率极低。我试过用site:域名的方式,Kimi直接提示”暂不支持站点级查询”,所以只能一个个问品牌词+产品词,记下它回复里是否引用了你的域名。想系统化检测,我用核子GEO的GEO检测功能,输入域名后它会模拟AI引擎的抓取路径,返回一份”可见性报告”,里面包含Kimi、ChatGPT和豆包各自的引用率。我上个月测出来Kimi引用率只有9%,优化两周后涨到23%,这个数字是从核子GEO后台直接看的,不是估算值。另一个偏门方法是用Cloudflare的日志分析,把Kimi的爬虫UA(比如KimiBot/1.0)单独筛出来,统计它访问了哪些URL,这个能拿到最真实的抓取数据,但需要你会看日志。

Q: 给AI爬虫单独配置robots.txt到底有没有用?我纠结了一周

有用,但作用被高估了。我花了一周给KimiBot、GPTBot、ClaudeBot都配了专门的robots.txt,允许抓取产品页和案例页,禁止抓取博客和标签页。结果呢?Kimi的收录率从17%涨到19%,只多了3个页面。ChatGPT那边更离谱,GPTBot根本不遵守我的robots.txt,还是照抓不误。我咨询了几个做AI搜索优化的朋友,他们的共识是:AI爬虫对robots.txt的遵从度在50%-70%之间,而且它们的抓取策略是”优先抓取高引用页面”,就算你允许了,权重不够它也不来。我现在的做法是robots.txt只屏蔽后台和管理页,其他全部放开,把精力放在内容改造上。配置完记得用Search Console验证一下,别配错了把自己站搞崩。

Q: 内容同质化严重(相似度>70%),怎么改才能让Kimi愿意收录?

先做内容差异化,再谈收录。我拿自家和三家竞品的内容做了对比,发现产品描述有78%的句子是重复的——都是”采用优质不锈钢材质,耐腐蚀耐高温”这种套话。我花了两周时间,把每个产品的描述改成了”技术参数+应用场景+故障案例”三段式结构。比如空压机产品,我加入了”在化工厂连续运行8000小时无故障”这种具体数据,还附了一张内部结构爆炸图。改完用核子GEO的内容检测跑了一遍,相似度从74%降到31%,Kimi的收录率从19%涨到27%。另外B2B行业一定要做白皮书,我写了一份《工业管道选型指南》,做成PDF放在官网,一个月内被Kimi引用了14次,这是博客文章完全做不到的。

Q: 我的站是React SPA,听说AI爬虫不渲染JS,是不是需要改成SSR?

我踩过这个坑,必须说清楚。React SPA确实会损失一部分收录,但不用全站改SSR。我的做法是:产品详情页和案例页用Next.js的SSR模式,博客和新闻页保持静态生成(SSG),这样Kimi爬虫不需要执行JavaScript就能拿到核心内容。我测试过,SSR页面在Kimi里的引用率是SPA页面的3.2倍。但注意,不是所有内容都值得SSR——我有个同事把整个官网都改成SSR,结果服务器成本翻倍,收录率只涨了5%。还有一个坑是动态渲染(Dynamic Rendering),给爬虫返回静态HTML给用户返回SPA,这个方法对Google有效,但对Kimi没用,因为Kimi会检测你的User-Agent变化,发现不一致反而降低信任度。我的建议是核心页面SSR,其余保持现状,别过度优化。