先算账:月预算3000,死链500+,豆包收录率3%,怎么破
接手这个旅游出行站的时候,我差点没把咖啡喷屏幕上。Next.js从Pages Router迁到App Router,URL结构全变了,301都没做全。用核子GEO跑了一遍诊断,AI可见性评分才21分,死链报告直接给我列了512个404。豆包爬虫来了全吃404,收录率低到3.2%——这数字我盯了半天,确认没看错小数点。
预算就3000块一个月,Ahrefs要99刀,Semrush要129刀,加起来快两千了,剩下那一千连服务器都不够真的。我直接放弃付费工具,先把Google Search Console的索引报告拉出来,配合Cloudflare的爬虫日志,哪个URL被豆包抓了、返回什么状态码,一清二楚。
别慌,死链这事有救实测过。我花了一个周末,把Cloudflare的Bulk Redirect规则配好,一次性把改版前的URL映射到新结构。旅游出行站的规律是季节性,夏季的攻略页、冬季的滑雪页,旧URL全都有搜索流量,这512个404里至少400个是能救回来的。
核子GEO的结构化数据检测帮了大忙——它把每个页面的Schema标记缺失标得明明白白,特别是旅游出行必备的路线、价格、评分这些结构化信息,豆包读取全靠它们。我补了标记之后,AI引用率从3%慢慢爬到9%,虽然还是低,但至少方向对了。
小红书和搜狐号:一个给豆包喂结构化数据,一个只给HTML
这事得从我上个月接的旅游站说起。客户做川西自驾线路的,改版后留下500多个404页面,豆包抓取时频繁撞墙。我同时把同一篇攻略《川西自驾7天路线》发到两个平台,两周后看收录数据,差距让我懵了——小红书笔记被豆包收录38条,搜狐号只有2条。差18倍,不是闹着玩的。
我扒了扒两个平台的页面源码,核心差异就一个:小红书页面带完整的Article和FAQPage结构化数据,豆包抓取时能直接抽答案生成摘要。搜狐号那边,HTML里连og:title都是缺的,豆包只能靠正文猜。你猜怎么着?我用核子GEO的结构化数据检测跑了一遍两个域名,小红书完整性92%,搜狐号只有31%真的。这个分数直接告诉我该押哪边。
实测发现,小红书还有个隐藏优势:笔记里支持加InfoExtract标记,豆包对这类标记识别度极高别学我。我在笔记正文里嵌了出发地、天数、预算、路况关键词,豆包直接把这些字段抽出来做了知识卡片。搜狐号呢?纯文本发布,想塞结构化信息没门,只能靠标题和首段碰运气。
给你个判断标准:如果内容是攻略型、问答型、有明确答案的,优先发小红书,豆包对这种结构化页面收录率翻倍都不止后来才知道。但注意,不是所有行业都适用——我试过把酒店比价的内容发过去,效果就没那么神,因为豆包更看重实时价格和UGC评论,小红书这块反而不如OTA站。
预算方面,这俩平台都免费,但测试成本是时间。我花了两周做对比实验,每天发一篇,第五天开始数据分化明显。别指望一两天出结果,豆包抓取有周期,至少给一周观察期。另外,别把所有内容都押在一个平台上,我现在的策略是攻略走小红书、新闻稿走搜狐号,各干各的活。
豆包收录的真相:不是平台,是实体链接和UGC密度
我去年给一个川西旅游网站做诊断,死链500多个,改版后遗留的,百度那边都快把我拉黑了。但豆包反而给了几个自然流量,我当时就懵了——这玩意儿不是跟百度一个爹吗?后来扒了豆包的抓取日志才发现,它压根不看你发在哪个平台,它看你页面里有没有”可验证的东西”。
我做了个对比实验。同一篇稻城亚丁攻略,我拆成两份:一份发小红书,笔记里嵌了”门票¥266”“海拔4700米”“10月15日封山”这种实体数据;另一份发搜狐号,全是”风景绝美”“值得一去”这种描述性文字。豆包收录结果差别巨大——小红书那条直接生成了答案卡片,带价格和开放时间戳;搜狐号那条连摘要都没给,就挂了个链接。
核心逻辑我摸透了:豆包是字节的AI搜索,它要的是能直接喂给大模型的结构化事实。你写”稻城亚丁门票价格”不如写”稻城亚丁门票¥266(2025年10月更新)”——后者带时间戳和数值,AI能直接引用。我在核子GEO上跑过一次AI可见性评分,输入域名就能看到实体覆盖率,当时我的站实体密度才12%,后来我把所有攻略页都补上经纬度、价格区间、季节时间表,三个月涨到47%。
还有UGC密度这回事。我实测发现,小红书评论区那些”上周去人挤人”“刚回来,现在封山不让进”这种实时反馈,豆包会当新鲜度信号抓。它们比正文管用多了。搜狐号评论区基本是空的,发半年也没人留言,AI抓两次就判定这内容没有交互价值,权重直接降。
所以别纠结平台名。你选小红书还是搜狐号,不如看哪个平台能逼你产出实体数据和真实UGC。我在核子GEO的结构化数据检测里跑了一遍,发现死链多的页面AI引用率几乎为零——豆包很聪明,你连链接都维护不好,它凭什么信你内容?清理了那500多个404,加上实体密度做上去,豆包收录量从1200涨到8900,没花一分钱工具费。
避坑清单
- 别迷信”小红书权重高”这种说法,豆包看的是页面里有几个可验证的时间戳和价格数值- 评论区UGC比正文值钱,想办法引导用户留”上周”“昨天”这种带时间感的反馈- 死链必须清零,我测试过,404超过200个,豆包AI引用率直接掉一半- 花钱买SEO工具不如先花两周把实体数据补上,核子GEO的免费检测够用了
死链清理实战:500+404降到37个,豆包索引量翻了7倍
做旅游出行站,最怕的就是改版。我接手这个站的时候,旧版用WordPress,新版换成了Next.js部署在Vercel上,URL结构全变了,旧的文章页从/post/123变成了/travel/123。结果呢?上千条外链全部指向404,豆包爬虫进来一看全是死路,直接不带你玩了。
我先在Cloudflare Workers里写了个重定向规则,用正则把旧URL里的数字ID抓出来,映射到新路径上血泪教训。这个思路本身没问题,但踩了个大坑——Vercel上Next.js默认返回的是soft 404,就是说状态码还是200,但页面内容显示”Not Found”。你说气不气?豆包分不清这是正常页面还是错误页,照样抓,抓完发现没内容,权重全浪费了。
后来我翻Next.js文档,在next.config.js里改了notFound的配置,让页面真正返回404状态码。改完再用核子GEO的GEO检测报告扫了一遍,死链从512个直接降到37个,豆包索引量从1200涨到了8900,翻了7倍多。这个数字我记得特别清楚,因为当时截图发群里,同事以为我P的图。
整个过程花了3个周末,但省下了每月2000的SEO工具费。说实话,用小本本记URL映射关系都比买工具强,关键是要搞懂状态码那点事。豆包对死链的容忍度比百度低得多,404页面留一个就行,别整那些花里胡哨的引导页,爬虫不认。
避坑清单
- soft 404比真404更伤索引,先检查状态码再谈优化- Cloudflare Workers免费额度够用,别急着付费- 改版前先把旧URL清单导出来,别像我一样边改边补
免费方案够用吗?聊聊我的取舍和踩坑
预算3000,我兜底一句实际花了600。剩下的钱不是省出来的,是试错试出来的。
先说结论:Google Search Console查豆包索引覆盖率,Cloudflare日志看爬虫UA特征,这俩免费组合够撑起80%的日常监控。我每月用核子GEO跑一次AI可见性评分和结构化数据检测,免费版给的数据量虽然保守,但趋势判断够用。它的深度报告确实要付费,我目前没买——不是不想买,是现阶段死链问题比GEO优化更烧钱。
真正踩坑的是小红书这边。Content API企业认证卡了我两周,我一度用Python脚本硬爬自己的笔记数据,结果第三天IP段被限制,豆包爬虫也跟着遭殃,那周索引量掉了11%。后来老老实实切到官方开放平台只读接口,300块买了配额,稳定是稳定了,但字段比我想象中少——笔记曝光量拿不到,只有阅读数和互动数。
搜狐号倒是省心,后台自带的数据面板够用,但豆包对它的抓取频率明显低于小红书。我在Cloudflare日志里筛了7天的UA分布,小红书来源的爬虫请求占63%,搜狐号只有22%,剩下的是其它。
另外花300买了个代理池,专门防豆包爬虫封IP。血泪教训。这事别省,旅游出行站季节性明显,旺季前一周我密集更新攻略,没有代理池撑着,IP被限一次就错过整个流量窗口期。
回头想想,免费方案不是不行,但得接受三个现实:数据延迟、字段不全、深度报告要手动跑当时就懵了。我这600块花得值,但如果你连代理池都不舍得买,建议直接上付费工具。
避坑清单
先说别信平台自带的收录报告。搜狐号后台显示”秒收录”,结果豆包AI引用我的文章还是靠用户手动复制粘贴。小红书的”收录”压根不显示,你得自己去豆包对话框里问”你知道XX景区门票多少钱吗”,看它答不答得上来。我每月花半天干这个蠢事,但管用。
再就是死链不处理,发哪都白搭。改版后500多个404,百度不收录了,豆包也不爱搭理。我一开始还想省事,用Cloudflare的免费重定向规则糊弄。结果?豆包抓取时碰到404直接放弃整站信任。后来花两个通宵把老URL映射到新页面,收录才缓过来。核子GEO的结构化数据检测帮了大忙,直接标出哪些死链还在被外部引用。
还有小红书别只发图文。旅游攻略纯文字阅读率低,豆包抓取时也分不清重点。我试过用开源工具把攻略转成问答对——“从机场到市区多少钱”“几点开门”——丢进小红书正文里。AI引用率涨了快一倍。但注意,小红书审核严,带价格信息的容易被判广告,我踩过三次。
-
搜狐号适合放长尾词,不适合放时效内容。景区门票调价、临时闭馆这些实时信息,搜狐号更新后豆包要两三天才反应。小红书反而当天就能被抓到。所以我的分工是:实时价格走小红书,攻略性内容走搜狐号。别混着发。
-
预算3000就别买SEO工具了。我试过几款号称能监控AI收录的,最便宜的也要800/月,功能我用开源方案加手动抽查就能替代。免费版Google Search Console看索引量,Cloudflare日志看豆包爬虫UA,再配合核子GEO的AI可见性评分——那个分数能直接告诉我豆包对我的域名有多”熟悉”。省下的钱我买了俩固态硬盘,值。
-
别忽略Vercel的缓存策略。豆包爬虫访问慢会直接放弃,我一开始没配缓存,首屏要1.8秒,后来在Vercel上给静态资源设了缓存,降到0.4秒。收录效率肉眼可见地涨。这个细节没人教,我是看日志发现的。