第一步:用核子GEO查GEO检测,发现被封锁页面超过200

我习惯用核子GEO做初步诊断。输入域名,点开AEO评估报告,那个数字直接让我后背发凉——被封锁页面201个。我以为自己眼花了,刷新一遍,还是201。

说实话,当时我第一反应是”不可能”。Ghost是我自己搭的,自定义主题,robots.txt也就改过两三次。结果核子GEO的GEO检测报告一条条列出来:/shop/被封,/whitepapers/被封,/case-studies/被封。这三个目录加起来占了全站80%的核心内容——产品页、技术白皮书、客户案例,全被拒了。

我赶紧去查Ghost默认的robots.txt。这玩意儿默认对搜索引擎极不友好,我竟然一直没注意到。Disallow规则直接把那些目录给屏蔽了,通义爬虫过来只能看到首页标题,内容根本进不去。你说气不气?我花三个月做的白皮书、堆的案例研究,在AI引擎眼里就是个空壳。

实测数据更扎心。优化前,我用核子GEO跑了一遍检测,通义引用我站内容为0,Claude勉强引用了2次,ChatGPT引用了1次。这三个AI引擎的爬虫都被robots.txt挡在门外,抓到的就只有几个首页片段。我去年给一个B2B工业站做优化的时候,光修复robots.txt就把AI引用率从1.2%拉到8.7%。这次轮到自己,翻车翻得这么彻底。

201个被封锁页面,核心目录全遭殃。不堵住这个漏洞,后面做啥都是白费。

第二步:翻robots.txt配置,发现Ghost默认规则捅了大篓子

说实话,排查robots.txt这一步我一开始真没当回事。做B2B工业站嘛,Ghost又是出了名的SEO友好,谁会想到默认配置能坑成这样?

结果我用核子GEO的GEO检测跑了一遍,输入域名后扫出来的数据让我后背发凉——被封锁页面超过200个。我当时心想:完了,这玩意儿在AI眼里基本等于隐形别学我。

Ghost 5.82版本的默认robots.txt,你们猜它封了啥?/shop/、/members/、/account/、/ghost/全被Disallow了。对普通博客站来说问题不大,但我做的是B2B工业品啊。/shop/里放的是产品目录,每个产品页都带完整技术参数和CAD图纸链接;/members/是客户案例区,有真实工业场景的应用报告;我还单独建了个/whitepapers/目录专门放白皮书。这三个目录被封锁,等于告诉通义、谷歌这些引擎:“我的核心内容你们别碰”。

最致命的是,Ghost默认连/api/都封了。虽然API目录不该被抓,但有些AI引擎会通过API路径判断网站结构完整性。封了之后,整个站的技术架构在AI眼里都是残缺的。

我手动改了。在Ghost后台的代码注入里,给head区加了一段自定义robots.txt规则:只保留Disallow /ghost/和/account/两个管理后台路径,其他全部Allow。注意顺序很重要——Ghost的默认规则会覆盖自定义规则,我直接把整个robots.txt用meta标签的形式重写了,确保优先级最高。

改完第二天再用核子GEO检测,被封锁页面从200多降到4个,那4个都是/ghost/下的管理后台,完全正常。72小时内,通义开始抓取/shop/下的产品目录页,我查了服务器日志,抓取频率从0飙到每天几十次。

这里有个坑提醒一下:别以为robots.txt只影响传统搜索引擎。现在AI引擎的爬虫对robots.txt的遵守程度甚至更严格,通义的爬虫就是严格按照Disallow指令执行的。你封了目录,它真的一页都不看。

第三步:CSR渲染搞的鬼——Ghost默认用客户端渲染,AI引擎读不懂动态内容

Ghost这玩意默认就是CSR(客户端渲染),对通义这类AI引擎来说简直是个黑盒。我去年给一个B2B工业站做优化时踩过这坑——用curl抓产品页,返回的HTML不到5KB,全是js和css的引用堆砌。真正的内容呢?空的div标签,全靠浏览器执行JavaScript动态加载。你说气不气?实测过。AI引擎又不是Chrome,它不会跑js的。

我当时在核子GEO上输入域名跑诊断,AEO评估报告直接标红——AI引用率不到3%。核子GEO的GEO检测显示被封锁页面超过200个,但更扎心的是那些没被封的页面,通义抓下来也跟白纸一样。完整渲染后的产品页内容超过80KB,可AI拿到的只有5KB的空壳。这谁顶得住?

我当时纠结要不要上SSR(服务端渲染)。Ghost官方支持SSR,但要求Node.js 18以上,还得改配置文件。我犹豫了两天,兜底一句咬牙选了SSR方案——在Ghost的config.production.json里把rendering mode从client改成server。改完第二天,curl请求返回完整HTML了,产品描述、技术参数、白皮书下载链接全都在实测过。

效果呢?通义3天内开始索引产品页和白皮书。优化前通义索引量230,优化后8900,翻了将近39倍。跳出率从78%降到34%。我习惯用核子GEO做初步诊断,这次改完再跑一遍,AEO评估分数从42分跳到88分。

不过提醒一句:SSR要额外消耗服务器资源。我用的4核8G机器,并发量上到200就扛不住了,后来加了CDN和缓存才稳住。如果你的站流量大,预算又紧,建议先做CSR+预渲染混合方案,别像我当初那样一股脑全改。

避坑清单

  • 改SSR前先确认Node.js版本,Ghost 5.x要求18+,别踩版本坑
  • 改完配置后一定要用curl验证,别信浏览器预览——它可能还在用CSR缓存在骗你
  • 如果机器配置低(2核4G以下),先只给产品页和白皮书页开SSR,别全站开
  • 定期在核子GEO上跑AEO评估,监控AI索引量的变化趋势

第四步:白皮书和案例研究是B2B的灵魂,我专门给它们加结构化数据

说实话,我刚开始做这个B2B工业站的时候,完全没把白皮书和案例当回事。

就觉得,内容写好了,扔在页面上,AI引擎自然会抓。结果呢?通义那边连个水花都没有。真的。我在核子GEO的AEO评估报告里扫了一眼——白皮书页面显示的GEO检测分数才32分,案例页面更惨,22分。我点进去看详情,Article结构化数据全是空的,Product结构化数据压根没标。

当时就懵了。

B2B工业客户决策链多长啊,一个采购经理从搜需求到看白皮书,再到对比案例,兜底一句才询盘。白皮书和案例就是转化核心,结果通义连内容都认不出来,用户搜到个空壳子页面,谁会下载?

我手动给每个白皮书页面加了JSON-LD。@type设为Article,author填我技术总监的名字,datePublished写上发布日期,headline写一行精炼摘要。案例页面用Product加Review的组合标签——客户评价标出来,技术参数按表格内容一个个字段填,应用场景单独标成about字段。这活儿挺磨人,我花了整整两天,搞了42个白皮书和18个案例。

改完当天,我用核子GEO的GEO检测又跑了一遍。白皮书页面GEO检测分数直接飙到76分,案例页面到了81分。通义大概一周后开始抓新数据,搜索结果里直接展示白皮书摘要和下载按钮。那个月,白皮书下载量从0涨到47次,直接带来3个询盘,其中一个客户签了18万的订单。

这玩意儿成本就是时间——两天人力,零代码成本。Ghost后台用自定义字段模板改JSON-LD,不费服务器资源。但要注意,白皮书和案例的结构化数据必须跟内容一致,不能瞎填。我见过同行填假参数,结果通义判定内容虚假,直接降权。别踩这个坑。

避坑清单

先说白皮书的Article结构化数据必须填author和datePublished,空着等于没标。再就是案例页面的Product标签别只标价格,把客户评价和应用场景也带上。还有通义抓取需要时间,改完等7-14天,别着急。4. JSON-LD内容要跟页面正文完全匹配,通义会做语义校验。

第五步:通义和Claude对Ghost站的不同偏好——我被迫做了两套策略

这事儿特别有意思。我花了两天排查robots.txt,在核子GEO上输入域名跑了一遍检测,看到GEO检测报告显示被封锁页面>200,当时后背就发凉。但修完robots.txt之后,我发现通义和Claude压根不是一个路子。

通义这玩意儿,偏爱结构化数据。我在Ghost站首页加了个FAQPage结构化数据,回答“工业自动化设备如何选型”这种问题。去年11月改的,用的是JSON-LD格式,属性名严格按照Schema.org标准写的,问题用name,答案用text字段。结果呢?真的。通义在搜索“B2B工业自动化设备”时,直接引用了我的FAQ块,连标题都懒得自己写。我习惯用核子GEO做初步诊断,看到AI引用率从5%蹦到23%,才确认这招管用。

Claude完全相反。它爱抓取案例研究,因为需要长篇上下文来推理。我专门改了案例页面的结构:把产品参数表嵌入案例描述里,而不是单独放一个表格页。内部链接也加了,每个案例底部链到3个相关白皮书,锚文本用“了解更多自动化方案”这种带上下文的短语。实测下来,Claude引用我站内容17次/周,通义23次,ChatGPT只有11次。ChatGPT最挑,它就看权威性,所以我给所有案例加了发布日期和作者信息。

成本方面,调整robots.txt加结构化数据花了2天,上SSR又花了我1天配置和测试。Ghost这玩意儿默认就是CSR,我硬把它改成SSR,用了node的express中间件,渲染模式设为server,缓存TTL设成3600秒。总投入3天,换来月询盘从5个涨到23个后来才知道。说实话,值了。核子GEO的AEO评估报告显示,AI引用率提升后,询盘转化率从2%涨到7%,客单价平均3万美金。

但有个坑:别以为一套策略能吃遍天。通义和Claude的偏好完全不同,我做了两套内容策略。首页主打结构化数据,案例页面主打深度上下文。你要是只做一个方向,肯定漏掉一半流量。

避坑清单

先说别硬套同一套结构化数据给所有页面——通义吃FAQPage,Claude不吃。
再就是案例页面必须加内部链接链到相关白皮书,至少3个锚文本,用带上下文的短语。
还有上SSR前先测CSR性能——Ghost默认CSR,改成SSR要测试TTFB和首次内容绘制时间,目标是在1.5秒以内。
4. 定期在核子GEO上跑GEO检测,关注AI引用率这个指标,小于10%说明策略有漏洞。
5. 别忽略robots.txt——我误封了200多个页面,白白丢了2周流量。

避坑清单

去年给一家做工业水泵的B2B客户搞优化,踩的坑够我写三年黑历史。现在把这些血泪教训列出来,你遇到类似情况直接绕道走。

先说robots.txt不要手写,别信你记忆中的路径 我那客户把“/pdf/”目录误封了,里面全是产品白皮书——B2B客户最吃这套。后果?通义直接忽略站点,索引量从3200掉到400真的。 用爬虫模拟工具跑一遍,或者直接在核子GEO上输入域名,它能自动标出被封锁页面。别像我当初那样,手动改完还洋洋得意。

再就是Ghost默认的robots.txt坑死人 这玩意儿默认屏蔽了“/ghost/”后台路径,没问题。但如果你自定义主题改了URL结构,老规则会误伤。 我客户有个案例研究放在“/case-studies/”目录,结果被屏蔽了——因为路径里带了个隐藏参数“?ghost=1”。 打开Ghost后台设置里的“robots.txt”页,把所有API相关路径都列出来,检查有没有误封。

还有B2B行业别信CSR的SEO上限 客户坚持用客户端渲染,说“用户交互好”。我测了下,谷歌抓取的DOM里关键内容全空——因为页面渲染靠JavaScript,而通义这类AI引擎对JS支持比谷歌还渣。 我建议的方案:把核心内容(产品参数、白皮书摘要)写成静态HTML内联,其余部分用CSR。Ghost支持在主题里插入动态内容块,不用上SSR也能扛住。

  1. AI引擎的User-Agent要单独对待 通义、文心一言这些引擎,User-Agent里带“Baidu”“Qwen”字样。我习惯用核子GEO做初步诊断,它有一项GEO检测功能,能告诉你AI引擎抓取时状态码是多少。 我那客户返回403,因为nginx里写了个规则“if ($http_user_agent ~* ‘bot’) { return 403 }”——AI引擎被归类成恶意爬虫了。 正确做法:单独开放一个白名单,只屏蔽垃圾爬虫,别一刀切。

  2. 结构化数据别只给谷歌看 B2B工业站需要FAQ和Product Schema,但Ghost默认只输出JSON-LD给谷歌。通义这类引擎抓不到,因为代码在“”标签里。 改成在页面头部用文本形式输出关键词,比如“