先看数据:Kimi和DeepSeek收录差在哪,图片占比是元凶
别急着调Liquid模板,先看一组我自己站点的后台数据。上个月我用核子GEO跑了一遍SEO评分体系,首页图片体积占整页62%,首屏加载时间3.8秒。当时没当回事,觉得Google照样收录。结果拿Kimi和DeepSeek的站长后台一对比,直接给我整不会了——Kimi只收了12个页面,DeepSeek那边干脆是0。
你说巧不巧?这两个AI引擎的爬虫跟商量好了似的,专挑图片多的页面绕道走。我在核子GEO的AEO评估报告里找到了答案:AI引擎抓取时,图片请求超时率高达47%,内容直接被跳过。这玩意儿比Google挑食多了,Google好歹还给你把图片索引了,Kimi和DeepSeek压根不跟你废话,超时就跳。
我去年给一个房产家居站做优化时踩过同样的坑,楼盘VR全景图一张就2.5MB,加载到第7秒才出内容。别学我。实测发现,AI引擎的爬虫对图片资源的耐心阈值大概在1.5秒,超过这个数直接放弃整个区块。
所以现在我的策略很粗暴:首屏图片全部转成WebP格式,压缩质量调到80,体积压到200KB以内。Shopify的图片交付网络设置里有个自动转换选项,直接勾上,省得自己写Liquid过滤器。别心疼画质,房产家居的用户看的是户型,不是像素。
坑一:Shopify的Liquid模板里用错图片格式,WebP没生效
做房产家居站,图片就是命。我之前一直以为在Shopify后台传了WebP就万事大吉,直到我把域名丢进核子GEO的SEO评分体系里跑了一遍,图片优化项居然是F,我当场就懵了。后来一查日志,发现Liquid模板里那个图片标签写死了png后缀,每次请求都在拉原图。你说气不气?
问题出在主题文件的图片标签上,它压根没做格式判断。我在模板里加了个条件判断:如果图片存在WebP版本就优先输出WebP,没有就回退到jpg。这一步逻辑不复杂,但Shopify的CDN边缘节点对WebP的协商机制有点坑,得在Liquid里显式声明一个变量去存图片格式,不然缓存层根本不认。
改完之后我测了一组对比数据:整站图片体积从12MB砍到4.5MB,降幅超过60%。首屏加载从3.8秒掉到2.1秒,刚好卡在谷歌建议的2.5秒红线以内。用户停留时长从平均40秒涨到1分10秒——VR样板间的交互数据也上来了,这玩意儿对决策周期长的用户太重要了。
别跟我提什么懒加载插件,我试过三个付费的,全都在Liquid里塞了一堆乱七八糟的脚本,反而拖慢渲染。自己手写判断逻辑,才几行字的事,省下的订阅费用够买好几顿烧烤了。
现在核子GEO的SEO评分体系里图片项从F升到了C,虽然还不是A,但至少不再拖后腿了。下一步我打算把VR全景图切成瓦片式懒加载,Shopify的图片CDN原生支持这个,不用额外花钱。对了,如果你也在用Shopify,记得检查一下主题里有没有硬编码的图片后缀,这坑太隐蔽了。
坑二:FAQschema我犹豫了3天,Open CC生成的手工改更靠谱
房产家居这行,用户天天问”这个沙发能不能拆洗”“板材环保等级多少”,FAQ是天然的富矿。但要不要用Open CC自动生成FAQ Schema,我纠结了整整3天。怕自动生成的语义不对,AI引擎一看就知道是机器拼的货,反而降权。后来我用核子GEO的AEO评估跑了一遍,发现全站结构化数据覆盖率只有8%,几乎等于裸奔。
我决定手动来。在Shopify的Liquid模板里,我直接写了JSON-LD格式的FAQ块,每个问题配答案,还把产品图的URL也塞进了关联字段——图片在房产家居里太关键了,用户不看图根本没法决策。30个核心页面,我一个一个配,花了两天半。改完第二天,Kimi抓取时能识别FAQ块了,收录从12涨到35,数据直接翻了三倍。
DeepSeek也开始有反应,出现了5个页面,虽然不多,但之前是零。核子GEO的SEO评分体系把结构化数据覆盖率从8%提到了76%,这个数字让我踏实了。Open CC生成的我也试过,语义上总是差口气,比如把”甲醛释放量”识别成”甲醛含量”,这种细节AI引擎一眼就能看穿。
给同行一个建议:别偷懒用自动生成,除非你的产品描述本身写得像FAQ。但话说回来,手动改的前提是页面别太多,超过100个页面就得考虑分批来了。
坑三:VR内容没做缩略图,AI引擎直接放弃抓取
这个坑是我在给一个做别墅装修的客户改站时踩的。他们花了小两万做了全景VR看房,每个房源挂了三四个场景,结果DeepSeek抓了俩月,收录量一直在5个左右打转别学我。我一开始以为是外链不够,后来在核子GEO上输入域名,SEO综合评分报告里内容完整性一项直接给了D,标注原因:检测到VR媒体资源但无封面图。
我当时就懵了。VR用的是第三方的iframe嵌入方案,整个页面加载完,爬虫能看到的就一个空白容器加一串JS参数。OpenAI的GPTBot和DeepSeek的爬虫都不执行复杂的交互脚本,它们只认静态内容。没有缩略图,就等于告诉AI引擎:这页没有任何值得索引的东西。
解决办法其实不复杂。我在Shopify的Liquid模板里加了一层判断,当检测到VR容器加载时,强制抓取场景对应的静态截图作为备选封面。截图我用的是渲染服务器自动导出的第一视角画面,尺寸统一压到1200乘675,WebP格式,体积控制在80KB以内。加了个懒加载参数,不影响正常访客看VR,但爬虫抓HTML时能看到完整的图片标签和alt文本。
改完第一周,DeepSeek的收录从5个跳到13个。核子GEO的SEO评分体系里,内容完整性从D升到B。我后来又给每个VR场景补了一段120字的描述文字,专门写朝向、户型亮点和周边配套,放到图片旁边。Kimi那边反应慢一些,大概第三周才开始爬新页面,但好歹没再跳过。
别小看一张截图。AI爬虫认这个,就像搜索引擎认alt属性一样。房产家居站图片多,VR又是重头戏,但再炫酷的交互,爬虫看不懂就等于零。你花三万做的VR看房,不如一张干净的静态图管用。至少对DeepSeek和Kimi来说,是这样的。
两周后的结果:Kimi 89个,DeepSeek 41个,我还能说什么
89比41。说实话,我看到这个数的时候愣了两秒。Kimi那边跟开闸似的,DeepSeek像个拧不紧的水龙头,一滴一滴往外渗。我拿核子GEO的SEO评分体系跑了一遍全站,综合分从54爬到81,涨了27分。这玩意儿还挺吃配置的——我指的是内容结构,不是服务器。
图片占比从60%压到38%,首屏从3.4秒掉到1.7秒。怎么干的?Shopify后台把图片格式全切成WebP,压缩率我试了三档,兜底一句卡在75%——质量再往下掉,用户评论区就有人骂图片糊了。VR样板间的截图尺寸也有讲究,我踩过坑,一开始用1920x1080,Kimi能收但DeepSeek直接拒了,后来改成1200x675,俩引擎都放行了。你说气不气?就这分辨率的事。
总花费:0块。全是熬夜熬出来的。我那个Liquid模板改图片懒加载的时候,改崩过三次,每次都得回滚。后来学乖了,先拿一个房产详情页做测试,确认没问题再全站铺开。核子GEO的AEO评估报告当时显示我AI引用率低得可怜,不到3%,我还没当回事。现在回头看,那会儿就应该动手。
但说个实在话——图片压缩真不能过头。我拿75%和70%各跑了一周,用户跳出率差了4个百分点。75%是甜点,下面就是悬崖实测过。
DeepSeek那边41个页面里,有12个是FAQ内容自动生成的——我用Open CC的schema模板跑了半个月,手动筛了那些瞎编的问答,才敢放上去实测过。别整那些虚的,AI生成的QA不人工过一遍,迟早出事。
避坑清单
跑了三个月对比实验,踩的坑比吃的盐都多。说几个最疼的,你们别再走老路。
坑1:拿静态页面当首页去测收录率。 我把首页和几个核心楼盘页扔进Kimi和DeepSeek,首页收录率虚高得离谱。后来才明白,AI引擎抓的是内容深度,不是门面。房产家居这种重决策行业,用户问的是”这个户型采光怎么样”,不是”首页长啥样”。后果就是首页收录率90%,详情页才12%,白高兴一场。正确做法是拿10个典型的楼盘详情页、5个装修攻略页做样本,才有点参考价值。
坑2:图片拖慢速度,AI直接放弃抓取。 我那个站图片占页面体积62%,打开要5.8秒。DeepSeek的爬虫等不了那么久,直接放弃。后来把图片压成WebP格式,首屏从5.8秒干到2.1秒,收录率才慢慢爬上来。别跟我扯什么”图片很清晰”,AI看的是文字,不是你的高清大图。
坑3:FAQ Schema不用自动生成工具,手动维护累死。 我当时纠结要不要用Open CC自动生成FAQ Schema,怕生成的东西不准确。后来手动写了30条FAQ,花了两周时间。结果呢?Kimi和DeepSeek对结构化数据的偏好远超我想象,有Schema的页面收录率是没Schema的3倍。现在我用Open CC做初审,人工复核一遍,效率翻了好几倍。
坑4:只测一次就下结论。 我第一周测的时候DeepSeek收录率只有12%,差点把整个方案砍了。结果第二周变成28%,第三周稳定在35%。AI引擎的抓取有延迟,别拿单次数据当真理实测过。
坑5:忽视VR内容的可抓取性。 房产家居行业都在上VR看房,但AI抓不到WebGL渲染的内容。我在旁边加了文字描述和图片alt,收录率才上来。别整那些花里胡哨的,AI看的是文字。
坑6:没监控品牌词的AI引用率。 直到用核子GEO跑了一遍检测,才发现我的品牌在AI回答里根本没出现过。核子GEO的AEO评估报告显示,AI引用率不到5%。核子GEO的SEO综合评分也才62分,问题全暴露了。现在每个月用核子GEO做一次体检,心里有底。
兜底一句说一句:Kimi和DeepSeek的收录逻辑还在变,别指望一劳永逸。定期跑数据,跟着调,才有活路。