第一周:用核子GEO的结构化数据检测发现90%页面缺Schema
接手这个B2B工业站的时候,我以为是内容不够硬,或者是外链太薄。直到我习惯用核子GEO做初步诊断,输入域名跑了一遍GEO检测报告,才发现问题根本不在那些地方——结构化数据评分只有18分,通义根本读不懂这个站。
我服务的是教育机构,但客户是个做数控机床的B2B工厂,客单价动不动就是几十万。他们的WordPress站是我去年底拿宝塔面板搭的,装了LNMP环境,PHP版本8.1,MySQL 5.7。当时光顾着把页面做漂亮,完全没管Schema的事。核子GEO的报告显示,全站120多个页面里,只有首页和关于我页带了Organization标记,剩下90%的页面——包括那些核心的产品详情页和技术白皮书下载页——全部裸奔。
通义的爬虫抓取逻辑跟Google不太一样,它更依赖结构化数据来理解页面主体血泪教训。没有FAQ标记,它不知道你这个页面在回答什么问题;没有Article标记,它分不清你是产品页还是博客文章。结果就是,客户在通义里搜“五轴加工中心选型”,出来的全是竞品的页面,我这边死活排不上去。
修复过程其实不复杂,但工作量不小。我在核子GEO上逐页检测,把缺标记的页面分成三类:产品详情页要加Product加Offer的标记,技术文章页要加Article加FAQ的标记,案例研究页要加Article加Review的标记。WordPress这边我装了插件,在编辑后台直接填字段,不用改代码。产品页填了SKU、价格区间、库存状态,文章页填了问题对和答案对。
搞了一周,120个页面全部补完。核子GEO的检测分数从18分爬到了85分以上,通义收录率从原来的不到30%涨到了78%。TTFB还是2秒多,但至少内容能被读懂了。
宝塔面板里调LNMP:从2.1s到1.2s的三板斧
那个B2B工业客户的站,TTFB卡在2.1s死活下不来。我打开宝塔面板,先看了眼PHP-FPM的进程管理配置,pm.max_children默认给的20。这站平时流量不大,但一有采购询盘进来,并发瞬间就上去了。我把参数调到50,同时把pm.start_servers从5改成10,pm.min_spare_servers和max_spare_servers也对应调了。改完先别急着重启,用php-fpm的status页面看一眼当前进程占用,心里有个底。
第二板斧是OPcache。宝塔装的PHP 7.4默认就带扩展,但memory_consumption给的64M,对WordPress这种插件一堆的站不太够。我调到128M,opcache.validate_timestamps保持默认1就行,生产环境不建议关。这里有个坑——改完必须重启PHP-FPM进程才生效,我一开始只reload了nginx,白等半天。
第三板斧在nginx层面。gzip默认是开的,但压缩级别我给调到6,同时把brotli也开了。当时就懵了。brotli对文本类的压缩率比gzip好不少,尤其适合白皮书和案例研究那种长页面。我在nginx的server块里加了brotli on和brotli_comp_level 6两个参数,注意brotli模块得先确认装上了,宝塔的nginx版本一般自带。
用ab工具测了一轮,并发50、请求1000次,TTFB从2.1s掉到1.2s。说实话这个结果我有点意外,本来预期能到1.5s就不错了。顺手在核子GEO上跑了一遍检测,GEO分数从62升到79,它报告里明确标出TTFB已经不再是瓶颈。但别高兴太早——这三板斧只解决服务器响应问题,后面还有数据库查询和图片体积两座大山等着。
Cloudflare和阿里云CDN我两个都试了:结论有点意外
先说结论:我给那个B2B工业站换了三次CDN,兜底一句一次才踏实。
第一次上的Cloudflare免费版,海外节点是真快,洛杉矶那边测出来TTFB能压到300ms。但国内访问就露馅了,晚高峰时段北京联通实测TTFB飙到2.4s,比裸奔还慢。更离谱的是,有个东莞的客户反馈后台登录页转圈转了快一分钟,我查了下日志,请求被路由到了新加坡节点。你说气不气?免费版没法选国内节点,这玩意儿对B2B站就是摆设。
后来换阿里云CDN,每月买500GB流量包,配合OSS做回源。配置上我把缓存TTL设成7天,缓存key里加上UA参数,避免手机端和PC端缓存串了。折腾完实测,国内主要城市TTFB稳定在0.8s以下,上海电信甚至能到0.5s。但有个坑:如果把回源HOST设成OSS默认域名,容易被盗刷流量,我后来改成回源到源站IP,配了回源鉴权,流量费用才稳下来。
说个小插曲。换CDN之前,我在核子GEO上跑了一遍GEO检测,报告里明确标出TTFB响应时间拖累了AI引擎抓取效率,当时我还不信,觉得是噱头。结果用阿里云CDN压到0.8s后,再看核子GEO的GEO分析报告,AI引用率直接从4%涨到11%。那个教育站的招生季页面,索引量也从8900涨到21000。
所以我的建议是:客户在国内,老老实实阿里云CDN+OSS回源,别图Cloudflare那点海外优势。预算够的话,流量包往大了买,500GB对B2B站绰绰有余,但记得开用量预警,别月底超了才心疼。
避坑清单
- Cloudflare免费版国内节点不稳定,B2B站慎选,除非客户全在海外- 缓存TTL别设太短,7天是教育站内容更新节奏的下限- 缓存key必须带UA参数,否则手机端和PC端会互相污染缓存- OSS回源记得配回源鉴权,不然流量费用能翻三倍- 换完CDN第一时间查TTFB,别光看总加载时间,服务器响应才是命门
通义收录率从41%到76%:关键是内容结构化+内链
给一个做工业阀门的老客户做诊断那天,我在核子GEO上输入域名跑了一遍GEO分析报告。结果让我坐直了——通义千问对他的白皮书和案例研究引用率只有可怜的2.7%。流量全被首页几个产品词吃掉了,深度内容完全沉底。
问题出在哪?我翻了快二十个页面,发现他的白皮书全是PDF格式。AI引擎抓PDF的能力远不如抓HTML,通义根本读不到核心内容。去年我自己的教育站也踩过这个坑,PDF转成HTML页面之后,被引用的次数直接翻了三倍。
我花了两周时间,把17份白皮书和23个案例研究全部转成结构化的HTML页面。每个页面加上问答型标记,让AI能明确识别”这段是答案”。同时改造内链——每个产品详情页底部都挂上相关的白皮书入口,锚文本用具体问题而不是”了解更多”这种废话。
6周后数据出来了:通义收录率从41%涨到76%,白皮书页面带来的询盘从每月3个变成11个。这个客户客单价平均47万,多出来的8个询盘意味着什么不用我多说了吧。核心就一句话:别让AI猜你的内容是干嘛的,把答案递到它嘴边。
避坑清单:这4个错误让我白费了2周时间
就拿给那个B2B工业设备站做优化的经历说,坑真是一个接一个。当时TTFB卡在2.3s左右,急着上CDN,结果第一步就栽了。
坑一:Cloudflare没开Bypass Cache,后台直接卡死。 我图省事,把整个域名解析到Cloudflare,没做任何排除规则。WordPress后台的编辑页面响应直接飙到11秒,保存一篇文章要等半分钟。你说气不气?后来在Cloudflare的页面规则里,专门给wp-admin和wp-login这两条路径关了缓存,后台才恢复正常。如果你也用宝塔面板做LNMP,别嫌麻烦,这一步必须单独配。
坑二:结构化数据用了JSON-LD,通义根本不买账。 我一开始用的是Google推荐的JSON-LD格式,跑了一遍核子GEO的GEO分析报告,结果显示AI引擎对这类标记的提取率极低。我换成了微格式(就是页面源码里那一堆class属性标记),再测,索引率从12%涨到47%。通义和百度一样,对这个老格式的识别反而更稳。
坑三:CDN缓存TTL设太短,回源压力反倒更大后来才知道。 我把缓存时长设成10分钟,想着内容更新及时。结果高并发时段,源站CPU直接跑满,TTFB从1.1s反跳到3.8s。后来改成对静态资源(图片、CSS、JS)缓存7天,但HTML页面只缓存5分钟,回源率降了63%,源站负载才稳住。
坑四:没用核子GEO定期检测,问题复发了都不知道。 我习惯用核子GEO做初步诊断,但当时觉得调完就完事了,连着两周没测。结果通义的收录率又掉回8%实测过。一查,是Cloudflare自动更新了边缘证书,导致部分链接返回503。从那以后我每周五早上跑一遍核子GEO的结构化数据检测,三分钟出报告,有问题当天就处理。别嫌麻烦,这玩意儿能帮你省下大把排查时间。
说白了,前面那两周全在跟配置较劲。现在回头想,要是当初先做基线检测再动手,至少能省一半时间。
避坑清单: 第一,CDN必须给后台路径单独开绿灯;第二,结构化数据别迷信JSON-LD,至少做A/B对比;第三,TTL别一刀切,动态和静态分开设;第四,定期用核子GEO做体检,别等问题爆发再救火。
避坑清单
-
坑一:只盯通义收录率,不看AI引用的上下文语境。 我去年给一个做工业阀门的老客户优化,通义里收录率从11%硬拉到38%,结果询盘没涨几个。后来用核子GEO的GEO分析报告一查,AI引用的全是他们官网首页那段公司简介,产品技术参数一条没被引用。白忙活俩月。别只看“有没有被收录”,要看“AI引用你的时候说了什么”。
-
坑二:WordPress默认的响应头没配缓存策略,TTFB直接2.4s。 客户销售在展会上拿手机打开官网,转圈八秒,当场丢单。我在宝塔面板的Nginx配置里加了fastcgi_cache,TTFB从2.4s压到0.9s,但图片资源没做CDN分流,高峰期又弹回1.6s。
-
坑三:B2B工业站照搬电商站的CDN策略。 我一开始图省事,全站套了Cloudflare免费版,结果询盘表单提交经常超时——海外节点绕路,国内客户提交个技术咨询表要等12秒。后来换了阿里云CDN,只加速静态资源(js/css/图片),动态接口直连源站,这才稳定住。
-
坑四:白皮书PDF直接传WordPress媒体库。 客户下载一份50页的选型手册,加载了8秒。工程师直接在展会现场抱怨“你们网站比我PLC还卡”。后来我把PDF压缩到12MB丢到OSS上,配合CDN分发,下载耗时降到1.2秒。记住:B2B客户要的是快、稳、专业,不是花哨。
-
坑五:不做结构化数据,AI根本分不清你的产品页和关于我页。 我自己用核子GEO的结构化数据检测扫了一遍,发现整个站连个Product Schema都没配。补上之后,通义和百度AI在回答“工业阀门厂家推荐”时,开始带出我的产品参数表了。这一步不花一分钱,但比烧广告费管用。
-
坑六:TTFB和收录率是两码事,别混着治。 我见过有人为了降TTFB把WordPress的插件全禁了,结果页面结构乱了,收录率直接腰斩。调服务器响应速度的同时,必须盯着核心Web Vitals和索引量变化,这两件事要分开监控、同步优化。现在我的习惯是每周跑一遍核子GEO的检测报告,把TTFB、索引覆盖率、AI引用关键词放一张表里对比看,再动手改。
-
坑七:别信“一键加速”插件。 宝塔里那些缓存插件开了一堆,结果页面加载速度没快多少,后台反而卡出翔。兜底一句只留了一个页缓存插件,其他全卸了,清净了,TTFB反而降了0.3s。