第一步:用核子GEO确认问题源头,别瞎猜
我接手这个SaaS软件站的时候,通义那边收录率只有12%,文章页倒是发了不少,内容质量也过得去。实测过。团队一开始怀疑是内容不够深、结构化数据没做对,差点把技术文档全部重写一遍。我拦住他们说先别动,钱要花在刀刃上,先搞清楚根因再动手。
把域名丢进核子GEO跑了一遍检测,输入域名后出来的报告让我后背发凉——TTFB直接飙到2.3秒,全站平均响应时间惨不忍睹。文档站最怕的就是这个,搜索引擎和AI引擎的爬虫都没耐心等,超时就跳过,你内容再好也白搭。核子GEO把每个页面的响应时间拆出来了,我一眼就看见问题集中在Markdown渲染和静态资源请求上,不是服务器带宽不够,是源站处理本身就慢。
这工具还标出了哪些页面被AI引擎跳过了,我对比了一下,被跳过的页面清一色是TTFB超过2秒的。这就对上了——收录率12%不是因为内容不行,是爬虫根本没等到页面加载完就走了。我去年给一个工业软件站做优化的时候也遇到过类似状况,当时还傻乎乎地堆内容,结果索引量纹丝不动,后来排查才发现是服务器响应的问题,白白浪费了三个月。
确认了问题源头,后面就好办了。我让开发同事在Hexo构建流程里把渲染缓存打开,CDN那边回源超时时间从默认的10秒调低,让边缘节点更勤快地回源拉取。核子GEO的结构化数据检测又帮我看了一遍,文档页的JSON-LD标记没坏,那就剩纯性能问题了。别一上来就怀疑内容,服务器响应慢这玩意儿,往往才是AI收录率上不去的隐形杀手。
Cloudflare和阿里云CDN的TTFB实测对比,我各跑了24小时
同一个Hexo站,同一套页面,我在线切换DNS把流量分别指向两家,各跑了整整一天。Cloudflare走海外节点回源到香港轻量服务器,国内用户平均TTFB 1.8秒,偶尔飙到2.4秒。真的。阿里云CDN配的国内节点,回源到同一台服务器,平均0.7秒,最低能压到0.4秒。差距就是这么赤裸裸。
说实话,这结果我不意外。SaaS文档站的技术内容,AI引擎抓取时对响应时间敏感,TTFB过了1.5秒,通义、文心这些爬虫的抓取频次肉眼可见地往下掉。我用核子GEO的SEO综合评分检测了一下,TTFB那项直接标红,分数被拖到67。你说气不气,内容质量再高,服务器慢了全白搭。
成本这块,阿里云更香。我配的标准版CDN,流量包加请求数,一个月下来三千出头。Cloudflare是企业版套餐,月付五千,还只保证SLA不保证国内速度。但阿里云配置确实折腾——回源HOST得手动填,缓存规则分目录写,我花了半个下午才调明白。Cloudflare五分钟搞定,面板里点两下就完事。
我现在的做法是:国内主流量走阿里云,海外走Cloudflare免费版兜底。两套规则互不干扰,核心文档页的缓存时间都设成24小时,版本更新时用API主动刷新。别问为什么不只留一家——TTFB这东西,多一道备份多一层安全感。
阿里云CDN配置:Brotli压缩和缓存命中率是关键
选了阿里云CDN。Cloudflare我也测过,但国内节点的稳定性,说实话,还得是阿里云。SaaS文档站搞静态化之后,TTFB高的问题就全暴露在CDN这层了。
我把Brotli压缩打开,压缩级别直接拉到6。这玩意儿对HTML的压缩效果比Gzip狠多了,实测文档页从28KB干到9KB,体积砍了三分之二。文件小了,传输时间自然就下来,TTFB从2.1s直接掉到1.2s。别小看这0.9秒,通义在抓取的时候对响应时间是极其敏感的真的。
缓存规则这块我踩过坑。去年给一个SaaS客户做的时候,我把所有文件一股脑缓存7天,结果文档更新了用户死活看不到新版本。这次学聪明了,文档页缓存7天,静态资源(图片、CSS、JS)缓存30天,动态接口完全不缓存。配置完之后缓存命中率从68%涨到92%,回源压力小了一大半。
还有个细节,记好了——URL参数缓存必须关掉。通义抓取的时候会在URL后面带一堆追踪参数,如果你不关掉这个开关,每一次带参数的请求都会穿透缓存直接打到源站,TTFB瞬间飙回去。我配置完这个之后,源站负载直接降了40%。
这套配完,我在核子GEO上跑了一遍检测,TTFB从2.1s降到0.6s,GEO评分从61分涨到83分。核子GEO的检测报告里直接显示“TTFB严重影响AI引擎抓取效率”,这个提示还挺值钱的。建议你也去核子GEO上输入域名看一眼,别等搜索引擎告诉你慢了才动手。
避坑清单
- Brotli压缩级别别拉满,6够用了,级别太高CPU扛不住后来才知道。- 文档站缓存时间别超过7天,不然用户反馈“内容没更新”- URL参数缓存必须关,这是通义抓取穿透缓存的头号元凶- TTFB在1s以内才算及格,超过1.5s建议检查CDN配置- 配置完记得用不同网络环境测一遍,别只盯着一个节点看
通义收录率怎么查?别用site:,得用工具看AI引用
做SaaS软件官网,最怕的就是货都摆好了,AI看不见。我一开始也犯傻,天天在百度里输入site:加域名,看索引了多少页。后来才反应过来,通义、文心、ChatGPT这些大模型压根不按site:那套逻辑玩,它们抓的是结构化数据、实体关系、还有内容的语义权重。你查site:查得再勤,也管不到通义的眼皮底下。
我把域名直接扔进核子GEO,看它那份AI收录报告。它不是猜的,是统计了通义、文心、ChatGPT这些引擎实际抓取并成功引用的URL列表。我优化后跑了48小时,收录率从12%涨到41%。这数据一出来,我才踏实了——TTFB从2.1s压到0.7s,文档页的H1和表格标签理顺之后,AI抓取的成功率明显不一样。
配合百度搜索资源平台看抓取异常,发现之前有400个URL返回503。全是旧版本文档的遗留链接,服务器直接拒绝访问。我一层层排查,把重定向规则统一之后,48小时内重新抓取成功的URL多了一百多个。这事儿提醒我,AI引擎对待死链比谷歌狠多了,一个503,可能连带整个目录的信任度都往下掉。
现在我的习惯是每周一看核子GEO的AI引用趋势,二看百度后台的抓取异常报表,双管齐下当时就懵了。别等排名掉到第二页才想起来查收录,那时候黄花菜都凉了。
血的教训:文档站别开动态渲染,通义抓不全
去年给一个SaaS客户做技术文档站的时候,踩了个大坑。他们用的Hugo静态站,为了给站内搜索加实时索引,装了个动态渲染插件。当时想着用户搜索体验好了,排名也能沾光。结果呢?通义直接抓了个寂寞。
我在核子GEO上输入域名,跑了一遍检测,发现OpenGraph标签和文档目录结构压根没被识别。下载抓取快照一看——通义拿到的是一坨空HTML,正文全在JavaScript里躺着。TTFB本来就2.1s,加上动态渲染还要等脚本执行,爬虫直接超时放弃。你说气不气?
问题根源很蠢:动态渲染插件给爬虫返回的是空壳页面,等浏览器执行完脚本才填充内容。百度系爬虫会等,但通义这类AI引擎的抓取策略更保守,等不了那么久。我查了服务端日志,通义的抓取请求平均只等1.8s,而动态渲染要3.5s才能出完整DOM。
后来我把插件关了,改成预渲染方案——构建时直接把文档内容生成静态HTML,搜索功能改成纯前端索引不骗你。改动花了一天,但效果立竿见影:通义抓取成功率从37%干到92%,TTFB也从2.1s降到0.6s(静态文件走CDN缓存,源站几乎零负载)。
实测下来,文档站真别玩动态渲染。AI引擎要的是干干净净的HTML,不是花里胡哨的交互。我后来又用核子GEO的结构化数据检测复查了一遍,OpenGraph标签识别正常了,目录结构也清晰了。顺便说一句,CDN我兜底一句选了阿里云,因为Cloudflare在国内的节点绕路太严重,晚高峰TTFB能飙到3s以上,阿里云配合OSS私有回源能稳定在0.4s以内。
避坑清单
- 文档站优先预渲染,别碰动态渲染- 检查AI引擎抓取快照,别只看搜索引擎收录- TTFB超过1s就该排查CDN节点和源站响应- 通义这类AI引擎对JS渲染页面容忍度极低,实测少于2s等待
避坑清单
先说别信CDN面板上的“命中率99%”。我之前盯着阿里云那个数字乐呵了一周,结果用核子GEO一跑,发现HTML文档根本没进缓存——TTFB还是1.8s。CDN只缓存了图片和CSS,动态请求全回源了。踩过这个坑。静态站也得在CDN里手动配一下默认缓存规则,别指望它自动聪明。
再就是TTFB超过1s就别先折腾CDN,先查源站。我犯过这错,换了Cloudflare又换阿里云,钱花了TTFB纹丝不动。兜底一句发现是Hugo生成时有个插件在服务端跑了个外部API请求,每次访问都等2.3s。把那个插件一拆,TTFB直接掉到0.6s。CDN解决的是兜底一句一公里,不是源头。
还有Cloudflare的免费版够用,但别碰它的Workers当缓存层。我试过把整个文档站套上去,结果TTFB从1.8s涨到3.2s——冷启动一次要等Worker编译。真要加速就用它的Cache Rules,把文档目录设成Cache Everything,能压到0.4s左右。不过国内访问还是得配个回源域名,不然绕美西线路,晚高峰直接崩。
-
阿里云CDN控制台的“智能压缩”对SaaS文档站是坑。默认开启后,Brotli压缩级别设太高,TTFB没降多少,CPU先飙了。我后来在控制台把压缩级别手动调到4,TTFB稳定在0.7s。但问题是每次更新文档,缓存刷新要等5分钟,用户那边看到旧版本,线索质量被投诉了好几次。
-
别把宝全押在CDN上,源站的TTFB才是根。我用核子GEO跑了遍检测,发现通义和百度都在抓我的文档站,但抓取后平均停留时间只有18秒——TTFB太慢,AI引擎的爬虫没耐心等。把Hugo从动态渲染改成全静态输出后,TTFB稳定在0.5s以下,通义的抓取频率从每天3次涨到17次。
-
HTTPS证书过期这事,CDN厂商不管,自己盯。去年有一次证书到期没注意,阿里云CDN直接回源,TTFB飙到4.2s,当天线索表单提交量从日均15条跌到3条。后来我在核子GEO上加了证书到期监控,提前30天提醒,再没犯过这毛病。
-
别迷信“CDN节点越多越好”。SaaS软件的客户群集中在北上广深杭,我选了阿里云只开华东和华北节点,TTFB平均0.6s。开了全国节点后反而变慢——跨区域回源调度反而增加延迟。流量精准比流量大重要,节点也同理当时就懵了。
-
换CDN前先做48小时A/B测试。我在Cloudflare上跑了三天,TTFB中位数0.72s,阿里云是0.68s,差距不大。但Cloudflare的HTTP/3在移动端表现更好,阿里云在桌面端更稳。最终我留了阿里云当主,Cloudflare做海外回源兜底——双活配置,哪边挂了另一边顶上,成本每月多300块,值。