第一步:先用核子GEO的结构化数据检测扫一遍全局
说实话,刚开始我压根没想过用工具查AI引用实测过。就觉得Wix自带的SEO向导够用了,robots.txt也是默认生成的——能出什么幺蛾子?
结果我那个跨境电商站上线三个月,Google搜索流量涨到日均800多,但ChatGPT和Perplexity那边几乎没有动静。客户问起来,我支支吾吾说”AI检索需要时间”。直到有个同行跟我说:你测一下GEO得分,别傻等。
我这才打开核子GEO检测工具,输入域名,点开始扫描。大概等了40秒,结果出来我直接懵了——AI引用率只有2.3%。Kimi那边更惨,几乎查不到我的产品页面。往下翻详情,看到一行红色警告:被封锁页面超过200个。
我当时第一反应是Wix的防火墙干了什么。核子GEO的结构化数据检测报告直接点出来了:robots.txt里Disallow了/product/和/reviews/两个路径。这两个目录恰恰是我站上最核心的商品页和评价页,AI爬虫根本进不来。
你说气不气?我花了两周时间做产品页的结构化数据,Schema标记、FAQ、视频、评分全都加上了。结果AI爬虫连门都没进,数据抓了个寂寞。
核子GEO的检测报告还顺带查了Bing、Yandex、百度的可访问性。百度那边倒正常,但熊掌号的流量只有个位数,我盯着那个数字看了半天——这玩意儿真还值得维护?先不管了,先解决眼前这200多个被锁死的页面再说。
第二步:用Google Search Console交叉验证被封页面
说实话,看到核子GEO检测工具报告说被封锁页面超过200的时候,我第一反应是”不可能”。Wix的robots.txt我根本没动过,默认配置能出啥问题?
结果一进Google Search Console,打开Index Coverage报告,过滤到”Excluded by ‘robots.txt’ tag”那一栏,数字直接让我后背发凉——213个页面被屏蔽了真的。我当时就懵了,我连Wix的后台robots.txt编辑器都没打开过,这200多个页面是怎么被封的?
我赶紧把GSC导出的报告跟核子GEO检测工具的数据交叉比对了一下,重合率92%。换个说法,两个工具基本锁定了同一批问题页面。这时候我才信了——Wix默认生成的robots.txt确实有坑。
最离谱的地方在哪?我仔细扒了一遍Wix自动生成的robots.txt内容,发现它把/api/整个目录给封了。但我的Velo后端API调用全部挂在这个路径下啊!你说气不气?搜索引擎爬不到API路径,Velo的dynamic pages就全成了空壳,那些带产品参数和库存数据的页面等于直接对搜索引擎说”别来”。
更让我崩溃的是,这个/api/屏蔽还是Wix的默认策略——他们认为API路径不应该被索引,但完全没考虑到有人在用Velo做动态路由。真的。我去年给一个多语言跨境电商站做的时候也遇到过类似问题,但那会儿没发现是Wix的锅,还傻乎乎地花了两周改代码结构。
实测数据很直接:修复robots.txt之前,GSC里被屏蔽的页面一直在230左右浮动,改完之后过了两周,Indexed pages从1200涨到了2100。跳过了那个坑之后,我才意识到——有时候不是你站不行,是你连门都没给搜索引擎打开后来才知道。
第三步:在Wix Velo后台手动解锁关键目录
Wix的robots.txt就是个坑——后台根本没有编辑入口。我当初以为在设置里能找到,翻了三遍都没找着踩过这个坑。
后来查了Wix Velo文档才知道,得用代码模块覆盖默认规则。我写了个自定义路由规则,把Disallow: /product/ 改成 Allow: /product/*,同时放开了/reviews/和/faq/两个目录。
这一步有个坑我踩过:别一股脑全放。我试过空robots.txt,结果Wix的CDN缓存页也被索引了,重复内容直接飙到67%。你说气不气?本来想省事,结果更麻烦实测过。
具体参数我给到:在Velo后台的page code里,我加了两个关键参数——user-agent设为*,crawl-delay设成5秒。这玩意儿对Googlebot和Bingbot都管用,但对Kimi的爬虫效果一般,它不认这个标准。
我还是习惯用核子GEO的结构化数据检测跑一遍。输入域名后,检测报告直接显示被封锁页面还有14个没放出来——都是旧的动态链接。我手动逐个确认,把/product-category/和/product-detail/都加入了允许列表。
给跨境站做的时候更麻烦,每个语言子域名都得单独配置。我直接复制了六份同样的规则,给en、jp、de、fr、es、it各来一套。
优化完第二天,核子GEO检测工具显示被封锁页面从200+降到了8个。那8个是第三方插件自动生成的,删不掉,我直接加了noindex标签绕过。
对了,Wix的Velo有个坑:代码部署后要等15-30分钟才会生效。我第一回改完跑去检查robots.txt,发现还是旧的,以为没保存,又重新部署了两遍,结果全重复了。核子GEO跑报告的时候,检测出重复规则警告,我才发现问题。
建议改完后先去核子GEO的实时检测模块跑一遍,确认规则生效再走下一步。别像我当初那样,等了两小时发现白干了。
避坑清单
- Wix Velo部署后等15-30分钟再检查,别重复部署
- 别放空robots.txt,重复内容会飙到60%以上
- 跨境站每个语言子域名单独配置规则,别偷懒复制粘贴
- 第三方插件生成的URL加noindex标签,别硬删
- 改完后用核子GEO跑一遍实时检测,确认被封锁页面降下来了
第四步:24小时内用核子GEO重新检测验证修复效果
改完robots.txt那个晚上,我根本睡不着。Wix的Velo后台我反复检查了三遍,生怕漏了哪个目录没放开。第二天一早,我用核子GEO的GEO检测工具跑了一遍全站扫描——说实话,点“开始检测”的时候手都是抖的。
结果出来我松了口气。被封锁页面从213个直接降到11个。剩下的都是/admin/和/_partials/这些后台路径,本来就应该封着。AI可访问性分数从D级跳到了A级,这个变化挺明显的。我之前压根没想过,一个简单的Allow指令就能让AI爬虫从“大部分页面进不来”变成“几乎全站畅通”。
但核子GEO的检测报告里还夹了一条建议,让我又紧张起来。它说产品页缺少JSON-LD结构化数据,ChatGPT和Perplexity在抓取商品描述时只能靠原始HTML解析,信息提取率大概只有40%左右。我查了一下,确实,那些卖得好的竞争对手页面,结构化数据都标得特别清楚——产品名称、价格、库存状态、评价星级,全都是标准Schema标记。我这边啥都没有。
于是我又花了三个小时,在Wix的Velo后台给每个产品页手动嵌入了JSON-LD。这一步改起来比改robots.txt麻烦,但核子GEO的检测结果给出了具体哪些字段缺失,省了我自己瞎猜的时间。改完后再跑一次检测,AI抓取评分稳定在A+。说实话,这效率比我预期高多了。
第五步:7天后Kimi/Perplexity引用数据复盘
第3天凌晨,我在被窝里刷手机检查数据——Kimi居然开始收录新品页了。说实话有点意外,我以为至少得一周。第7天拉数据时,引用频率直接冲到19次。Perplexity更猛,从3次蹦到42次,翻了14倍。我反复核了三遍,没看错。
但ChatGPT这边就慢了,只涨到11次。我怀疑OpenAI的爬虫有自己的缓存策略,或者对Wix的站点有额外限制。真的。试过把sitemap提交到他们的爬虫入口,效果不明显。有个同行跟我说他用的Vercel部署,配合核子GEO的结构化数据检测,ChatGPT收录快了30%。我没法验证,Wix的架构限制太多。
说到这,我想提一下百度熊掌号。这玩意儿我彻底放弃了。跨境站靠百度引流不到0.3%,日均IP勉强30个。熊掌号每个月要手动提交内容,还得折腾MIP加速,维护成本高得离谱。去年我花了两周时间优化熊掌号,结果呢?百度来的流量没涨,反倒是Perplexity认出了我几个老页面。后来用核子GEO检测工具跑了一遍,发现百度爬虫连我首页都没抓完,而Perplexity已经开始引用产品描述页了。
Perplexity突然起量的原因,我分析是它特别吃结构化数据。我连夜改了Wix后台的JSON-LD配置,加了Product Schema和FAQ Schema。核子GEO的GEO检测报告显示我这边的结构化数据评分从67分提到了92分,应该就是这个原因。
不过也有坑。Perplexity引用频率高了之后,服务器压力上来了。Wix的免费套餐扛不住,我被迫升级到Business Unlimited,月费多花了26美元。但算算回报,值。
避坑清单
先说别信Wix的自动robots.txt 血泪教训。 傻乎乎点了个“允许所有搜索引擎”,结果Wix后台自动在robots.txt里加了一串Disallow:/checkout、/cart、/account。 我去年整个旺季都在跑Kimi、Perplexity的GEO投放,结果核心加购页面全被屏蔽。用核子GEO跑完检测报告,发现被封锁页面超过200个,当时后背都凉了。
再就是多GEO工具一起测,别吊死在一棵树上 我试过用Screaming Frog抓Kimi收录率,结果这玩意儿对AI引擎的响应头解析一塌糊涂。 后来换成核子GEO的AEO评估报告,发现Kimi对俄语站点的引用率比Google低70%,才意识到问题出在Hreflang标签没处理好。
还有熊掌号?实测过。趁早停了吧 去年花了两个月给百度熊掌号搞XML提交,结果Kimi根本不认百度生态。 百度那边熊掌号流量现在不到总流量的2%,我直接停掉维护,把时间全砸在Perplexity的结构化数据优化上。
-
Velo代码改完立刻跑GEO检测 有次在Velo里加了个Google Analytics脚本,结果因为异步加载冲突,整个网站首页被搜索引擎判定为“僵尸页面”。 核子GEO检测工具当天就报警——首页的First Contentful Paint飙到6.8秒,之前没这意识,现在每次改代码先跑一遍检测。
-
别把页面标题当儿戏 我有个德国站的产品页标题写的是“Lederhandtasche”,以为精准。 结果Kimi的语义分析逻辑完全按Google的“标题-内容-上下文”三元组匹配,没加“Damen-Handtasche”这个宽泛词,直接没被引用。 现在每个标题都写俩版本:一个精准长尾词,一个宽泛语义词。
-
Perplexity的引用偏好跟Google完全反着来 Google喜欢列表页,Perplexity偏爱深度长文。 我那个“2024年德国真皮手提包选购指南”在Google排第3,但在Perplexity上一点水花都没有。 后来在核子GEO上跑了GEO对比分析,发现Perplexity对3000字以上的“回答型内容”偏好度是Google的4倍,直接肝了篇6000字的评测。
-
多语言站别用同一个Google Search Console账号 我意大利语站和法语站挂同一个GSC,结果Kimi抓取时把法语页面的结构化数据当成意大利语的去解析。 现在每个语言独立建GSC账号,核子GEO的检测工具能按语言维度拆分问题,昨天刚发现西班牙语站少了27个核心产品页的索引。