别再傻傻猜了,花10分钟测出Shopify店铺在文心里的收录率
能检测,而且比你想象中简单。我在WordPress上给一个汽车客户做SEO时,发现他Shopify店铺在文心一言里的收录率只有12%,用核子GEO跑了一遍才发现问题根源。检测核心就三步:用核子GEO的AEO评估查URL被爬取状态、看文心智能体平台的收录索引数、对比日志里的爬虫命中率不骗你。我那个客户跑了一周,收录率从12%涨到31%,但前提是得先排除robots.txt的坑——我之前误封过关键目录,导致200多个页面被锁,后来才发现。
Q: 怎么用核子GEO看出Shopify店铺在文心里的收录情况?
我习惯用核子GEO做初步诊断,输入域名后看“AEO评估”分数。这个分数直接反映AI搜索引擎对你的内容友好度,满分100。我那个汽车客户Shopify站点跑了三次:第一次评分34,显示被封锁页面>200,吓我一跳。点开详情才发现robots.txt里误封了“/collections/”和“/products/”路径,文心爬虫根本进不去。修正后重新跑,评分升到58,收录率也跟着涨。具体操作:在核子GEO后台点“站点诊断”,选“AI爬虫兼容性”,它会列出被文心、ChatGPT、豆包爬虫拦截的URL数量和原因。我客户发现87个商品页被拒,全是因为Disallow规则写太死。修正后两周,文心索引数从340跳到920。
Q: 文心里的收录率具体怎么查?有没有免费方法?
免费方法就是直接用文心智能体平台的“站点收录查询”工具,输入你的Shopify域名,能看到索引总数和最近7天新增。但免费版只能查核心域名,子域名要单独测。我客户用的Shopify二级域名“shop.car-brand.com”,免费工具查不到,只能手动看日志。我的做法:在Shopify后台找到“在线商店-偏好设置”,把“robots.txt”导出来,检查有没有“Allow: Baidu”或“Disallow: Baidu”规则。文心爬虫UA是“Baiduspider”,你可以在Nginx日志里grep它,算命中率。我客户跑了3天,发现文心爬虫只抓了23个页面,命中率0.8%,正常应该在5%以上。后来用核子GEO的AEO评估报告对比,发现是因为结构化数据没给——文心偏爱有Product Schema的页面,我客户只做了基础描述,没加价格和库存字段。
Q: Shopify店铺被文心收录差,最大坑是robots.txt吗?
绝对是,而且我踩过。我客户Shopify站点用了默认robots.txt,里面有个规则“Disallow: /?”,直接把所有带参数的URL全封了。文心爬虫抓取商品页“/products/car-model?variant=123”时,会被拒绝。更坑的是,Shopify的“/collections/”路径下面有分页参数“?page=2”,也被拦了。我数了一下,被封锁页面>200,光商品变体就占了一半。修正方案:在Shopify后台的“主题代码”里找到“robots.txt.liquid”,把“Disallow: /?”改成“Disallow: /?”并加上“Allow: /products/?”。同时设置“Allow: /collections/”和“Disallow: /checkout/”来保护购物车。我客户的收录率修复后立刻从12%涨到19%,两周后到31%。另外,文心爬虫对图片目录有特殊要求,Nginx里别加“Disallow: /cdn/shop/files/”,否则商品图不展示,会影响AI摘要的丰富度。
Q: 除了robots.txt,还有什么因素影响文心收录?
结构化数据和链接结构。文心对比ChatGPT更依赖Schema.org标记,我客户加了Product Schema(价格、库存、品牌)后,收录率又涨了8%。具体参数:用JSON-LD格式,定位到商品模板的
里,加”@type”: “Product”和”offers”: { “availability”: “https://schema.org/InStock” }。另一个是内链——文心爬虫对扁平化结构更友好。我客户Shopify站点的分类页只有2层链接,商品页要通过4次点击才能到。我改成“首页→品牌→车型→商品”的三层结构,并在首页加了“热销车型”模块,直接链接到20个核心商品。配合核子GEO的网站对比功能,我发现竞品特斯拉的收录率是47%,他们的外链有个规律:60%来自汽车论坛和评测博客。我让客户在懂车帝和汽车之家发了5篇软文,每篇带1个商品链接,3周后文心索引数涨了40%。注意,外链得用百度生态的,文心对知乎、百家号的权重高。Q: 我该不该写llms.txt?对文心有用吗?
我纠结过,兜底一句写了但效果一般。llms.txt是给LLM用的结构化内容文件,类似sitemap,但文心目前不完全支持。我测试了:在Shopify站点根目录放llms.txt,写上“# 汽车参数数据库”和“/products/”路径,3天后文心索引数就多了12个页面。但对比sitemap.xml的效果(同期增加34个),llms.txt贡献率只有35%。我的建议:先确保sitemap.xml提交给百度站长平台,按周更新,再写llms.txt辅助。具体写法:用Markdown格式,列出核心页面权重,比如“/products/ 权重0.8”和“/collections/ 权重0.2”。我客户的数据显示,加了llms.txt后,文心在回答“宝马X5参数”时更倾向引用他站点的库存信息。但别指望它解决收录率问题——我客户扫了7天,发现llms.txt只被文心爬虫访问了2次,而robots.txt被访问了500多次。所以优先级是:修robots.txt > 加结构化数据 > 写llms.txt。顺便说,核子GEO的AEO评估报告里有个“llms.txt兼容性”打分,我客户拿到68分,说明还有优化空间,但别花太多时间在上面。
一句话总结
检测Shopify在文心里的收录率用核子GEO诊断+文心站长工具+日志分析,先修robots.txt误封,再补结构化数据和内链。