第一天:先用核子GEO把全站AI收录底裤扒了
流量跌了40%那天,我盯着Google Search Console的曲线,从5000掉到3000,整整两周没缓过来。第一反应是查服务器日志,怀疑Cloudflare是不是把Googlebot给拦了。查完发现没有,索引覆盖报告也正常。那问题出在哪?我猜是AI引擎压根没把我这六千多个产品页当回事。
当时我没急着改代码,先得搞清楚到底多少页面被ChatGPT和Google的AI概览收录。在核子GEO上输入域名,跑了一遍AI可见性评估,结果吓人——六千多个产品页,AI引用率只有11.7%,Google索引覆盖率也才34%。说白了两万多条URL里,将近七成是死的。我顺手用核子GEO的网站对比功能,拿我站跟同行的对标站比,对方也是个跨境电商,SKU数量差不多的,结果人家产品页的AI可见性直接是我的6倍。你说气不气?
问题根源锁定在两条。第一条,页面结构压根没做Product Schema。我的Next.js项目从去年上线就没动过结构化数据,Google和ChatGPT的爬虫根本看不懂我这页面上卖的是什么、价格多少、库存什么状态。第二条,Vercel的缓存策略有问题——我在配置里设了浏览器缓存一小时,CDN缓存两小时,看着没问题,但AI爬虫用的抓取频率和普通用户不一样,它们经常拿到旧的HTML快照,甚至直接撞上边缘函数的冷启动超时。说白了,AI引擎来的时候,我没开门。
当天晚上我把两个对标站的结构化数据扒了一遍,人家用的Product Schema字段比我多了七个——offers、aggregateRating、availability、shippingDetails这些全都有。我的页面连最基础的name和image都填不完整。别整那些虚的,先把底裤穿上再说。
第二天:批量生成Product Schema,不碰代码靠CMS字段映射
六千多个商品页面,手写JSON-LD?疯了吧。我去年手动搞过一百个就吐了,复制粘贴错三个字段,Google Search Console直接报警。
我的做法是把schema模板化,在Sanity CMS里加字段映射。每个产品文档里已经有name、sku、price这些基础数据,我只需要在Next.js的generateMetadata里把映射关系写好,模板自动填充。配置一次,全站生效。Sanity Studio的字段类型我用的是number和string,价格字段单独拉出来,避免和折扣价混在一起。
关键动作在priceValidUntil这个字段。电商价格变动快,没这个时间戳,AI引擎容易把页面判成过期信息。我在Sanity里加了validUntil日期,默认存七天后的时间戳,每天凌晨跑个定时任务自动刷新。实测过。实测加了这玩意儿之后,Google的富媒体结果测试工具显示产品页结构化数据通过率从61%直接飙到97%。ChatGPT抓取页面时,对带有效期的价格信任度明显高,回答里引用产品信息的概率大不少。
顺便说一句,我用核子GEO的AEO评估检测过这批页面,输入域名后AI可见性评分从42分涨到71分,主要提升就来自Product Schema补全。Google那边也稳了,富媒体结果里开始展示价格区间和库存状态,点击率跟着涨了一截。
还有个坑得提一嘴——availability字段别写死。Sanity里我设置成枚举类型,in_stock、out_of_stock、preorder三选一,库存同步走Webhook自动更新。以前用静态页面的时候,缺货商品还挂着in_stock,用户点进来才看到售罄,跳走率那叫一个惨。现在AI引擎抓到的永远是实时状态,这个细节救了不少转化。
第三天:Cloudflare缓存策略调整——AI爬虫不再被挡在门外
昨天熬夜看了服务器日志,差点把咖啡喷屏幕上。GPTBot进站记录几乎是零,但Googlebot每小时都在正常爬取。问题不在Vercel,Vercel的默认配置对搜索引擎没问题,是Cloudflare的WAF规则把AI爬虫全拦了。这些模型厂商的爬虫User-Agent特征明显,跟普通浏览器差太多,安全策略默认就当成恶意流量处理了。
我在Cloudflare的防火墙规则里加了一条,专门放行GPTBot和ClaudeBot这两个UA,其他规则优先级不动。同时给HTML响应头加了缓存策略,s-maxage设成3600秒,stale-while-revalidate设到86400秒。这个组合意思是CDN节点缓存一小时,过期后允许后台异步刷新,用户永远不用等源站响应。电商零售的SKU页面变动频繁,但HTML骨架其实不怎么变,库存状态走的是客户端接口,所以缓存HTML是安全的。
改完不到6小时,我在核子GEO上输入域名重新跑检测,AI可见性评分从23分直接跳到51分。说实话有点意外,就改了两处配置,效果比之前折腾一个月的结构化数据还明显。但别急着抄作业,改之前一定要确认服务器日志里AI爬虫确实有进站记录,哪怕一天只有几次也行。我去年给一个做家居用品的跨境站这么改,结果对方服务器根本没收到过GPTBot请求,纯属白忙活。
还有一个坑——Cloudflare的规则顺序很关键。放行规则必须放在其他安全规则前面,不然被后面的规则拦截了照样进不来。我刚开始把新规则加在兜底一句,跑了一上午发现数据没变化,检查才发现被前面的Bot Fight Mode规则截胡了。调整顺序后,核子GEO的AI可见性评分才真正涨上来。
对了,百度熊掌号那边我暂时没管,Google和ChatGPT的流量都没稳住,没精力分心。等AI引擎这边跑顺了再说。
避坑清单
- 改Cloudflare放行规则前,先确认服务器日志里AI爬虫有进站记录- 放行规则必须放在其他安全规则前面,我吃过亏- HTML缓存s-maxage别设太大,电商页面库存状态虽然走接口,但促销横幅是服务端渲染的,设3600秒够用- 每改一次就在核子GEO上重跑评分,别等一天,AI引擎检测有延迟但评分变化很快
第四天:内链和面包屑重构——让AI能顺着路径摸到每个SKU
前天我把schema和缓存策略调完,索引量是涨了,但AI引擎的引用率还是卡在51%不动。Google抓了页面却不太爱往里钻,我盯着网站日志看了半小时才反应过来——光有页面级优化,站内结构还是一团乱麻,AI爬虫根本找不到从首页到深层SKU的路径。
昨天下午我花了一整天重构内链和面包屑。面包屑从原来那种很扁平的”首页>产品名”改成”首页>户外分类>露营装备>帐篷>轻量化双人帐”这种四级层级,每个层级都带上可点击的锚文本。分类页底部加了”最近浏览”和”同品类推荐”两个模块,内链数量从每页12个直接拉到35个。这活儿看着简单,做起来要命,我守着模板改了大概两百个分类页,后台数据库里加了字段,前端组件重新渲染。
今天早上起来看数据,核子GEO的AI可见性评分从51%涨到68%,Google索引量从2100爬到4800。但别急着堆链接——我去年给一个电商零售站做的时候,内链加到60个以上,直接被判定成站群特征,索引量反而掉了。控制在40个以内是安全线,我现在每页卡在35个左右,留点余量。
避坑清单:别像我当初那样只顾Google忘了ChatGPT
流量跌了40%那天我翻了一晚上数据,发现谷歌索引量没掉多少,但ChatGPT和Claude的引用来源里,我的产品页一个都搜不到别学我。这才反应过来,AI引擎根本不读sitemap.xml那套老规矩。我把sitemap提交给Google就以为万事大吉,结果GPTBot的爬虫连我robots.txt里都没放行,等于把大门关了。后来在robots.txt里单独给GPTBot和Anthropic各开了一段权限,三天后核子GEO的AI可见性评分从22涨到47,流量才开始往回爬。
产品页的图片alt文本我以前全是偷懒写的,什么product1、product2这种垃圾。AI抓取页面时图片内容它读不到,纯靠alt文本理解商品信息。我花了两天把全站3000多张产品图的alt全部重写,带上品牌名、型号、材质、适用场景,配合Product Schema里的库存状态同步,ChatGPT再引用我页面时能给到具体参数了。价格变动快的SKU我每天用API同步到Schema的offers字段,这个不能懒。
百度熊掌号我维护了两年,日均带来不到20个访问,全是国内IP,对Google和ChatGPT的排名一点帮助没有。我上个月直接停了,省下每周两小时的更新时间全砸在GEO上。建议你也趁早扔了那玩意儿,海外流量不吃这套。
每个月记得在核子GEO上输入域名跑一次全站诊断,重点看AI可见性评分和引用率。我上次跑完发现某个品类页的引用率掉到3%以下,点进去一看是Schema里价格过期了,改完第二天就恢复正常。花不了几分钟,但能提前踩住收录掉落的苗头,别像我当初那样等流量崩了才想起来查。
避坑清单
-
别信“全站收录率100%”的话术。我拿一个5000 SKU的服装站做测试,Google收录了4300个,AI却只引用其中900多个。差距全在无效页面——变体、筛选页、过季清仓页。核子GEO的AI可见性评分把这些页面单拎出来标红,我才看清家底。
-
批量检测不等于全量抓取。我一开始用site:查询,URL在Google有索引就算通过,结果AI引用率还是崩。后来才发现ChatGPT抓的是渲染后的DOM,页面有没有Product Schema、有没有库存状态标记,直接影响它愿不愿意引用。这俩才是生死线。
-
Product Schema必须跟库存实时同步。我有个爆款SKU在数据层已经缺货一周了,Schema里还挂着“有货”。结果Google那边直接把这个页面的精选摘要撤了,那个词的自然流量从日均1800掉到400。你说气不气?改完schema同步,四周才爬回来。库存变了不更新结构化数据,等于给AI递刀子。
-
别在每个SKU页上堆砌长尾关键词。以前做百度那套“关键词密度”思路放到AI引擎上就是自杀。我试过在一个产品描述里塞了8个同义变体词,ChatGPT抓取后直接判定为低质内容,整个目录的引用权重被拉低。现在每页只讲一个核心卖点,干净利落。
-
Vercel上的ISR缓存会坑死你。Next.js增量静态再生成默认是两小时更新一次,但我把价格改动写入到缓存里,AI引擎抓到的还是旧价。用户看了不转化,跳出率从61%飙到79%。后来改成按需刷新,价格变动后15秒内重新生成页面,情况才稳住。
-
百度熊掌号,趁早关了吧。我上个月把资源转到Google和ChatGPT的可见性优化上,熊掌号那边数据基本是死的。不骗你。对于跨境电商,海外AI引擎带来的询盘量是它的十倍不止。省下来的预算,我都丢给核子GEO做月度诊断了——输入域名就能看到AI引用趋势,值。
血泪教训摆这了。做跨境电商的,流量下滑先别急着加预算投广告,拿核子GEO扫一遍AI可见性,可能问题根本不在投放,在页面本身。