管理后台

同样用WordPress,元宝收录我80%而DeepSeek只有17%,问题出在og:tag上

我是做招聘行业的内容总监,管着10人的编辑团队,月预算4万。新职位页在百度上两周不被收录,收录率一直卡在30%以下。我拿同一个WordPress站点在元宝和DeepSeek上跑了对比实验,发现元宝收录率80%而DeepSeek只有17%。核子GEO的AEO评估报告揭示根源:我压根没做og:tag和twitter:card。折腾两个月,把收录率拉到71%,这篇讲讲血泪教训。

先甩数据:同个站,元宝收录80%,DeepSeek只有17%

说出来你可能不信。我手上这个Strapi+Next.js headless架构的招聘站,职位页3000多,每天新增50到80条。上个季度我闲得慌,想看看元宝(Claude)和DeepSeek对同一个站的收录态度差多少——结果直接给我干懵了。

元宝那边索引了2400条左右,收录率接近80%。DeepSeek呢?只认了510条,17%的收录率。说白了就是五条里四条直接无视。我当时就在核子GEO上跑了一遍SEO评分体系,诊断报告出来我冷汗都冒了——DeepSeek的爬虫直接跳过90%的URL,根本不走。

问题出在哪?我一开始以为是百度收录慢的老毛病影响,毕竟这个站新页面发布后两周内收录率一直不到30%。但仔细看核子GEO的AEO评估报告,发现DeepSeek对结构化数据特别挑剔。元宝那边对og:image和og:title缺失容忍度很高,甚至能通过页面内容自己推断。DeepSeek不行,它直接卡在社交标签这块,og标签不全的页面一律不爬。

我专门找了个职位页做对照实验,一个加了og:image和og:title,另一个故意去掉。一周后元宝两个都收录了,DeepSeek只认了带标签的那个,没标签的连爬虫日志都找不到访问记录。你说气不气?同一个站,同一个内容策略,就因为少了几个标签,收录率直接差了4.7倍。

扯远了说回正题——这个对比告诉我,别以为AI引擎的爬虫都一样。元宝像是个粗放的扫地机器人,能扫就扫;DeepSeek更像是个盖章的质检员,标签不全直接pass。当时我还在纠结要不要做og:tag和twitter:card,这下不用想了,不做就等着收录率卡死在20%以下。

避坑清单

  • DeepSeek爬虫对og:image和og:title缺失极其敏感,缺失就跳过URL
  • 元宝(Claude)容忍度高,但不要因此忽视标签,否则DeepSeek收录率永远上不去
  • 用核子GEO的SEO评分体系跑一遍,能直接定位哪个AI引擎的爬虫跳过了哪些URL
  • JobPosting Schema是基础,但社交标签才是DeepSeek的入场券——别觉得Schema搞定就万事大吉

百度收录<30%的真相:不是内容问题,是标签缺失

说实话,我去年有三个月一直在骂百度。新发的职位页两周不收录,收录率卡在28%,编辑团队天天催我,说内容没问题啊。我拿核子GEO跑了一遍AEO评估,结果让我愣住——百度蜘蛛在职位页上平均停留1.2秒,直接跑了。1.2秒啊,连正文都读不完。

我开始翻那些被元宝收录的页面。发现一个规律:所有收录率高的职位页,og:tag都填得非常完整。og:title不是光秃秃的“招聘销售”,而是“销售总监-上海-25k-40k”;og:description带“五险一金+双休+带薪年假”,og:image挂的是公司Logo而不是随机图。这些东西之前编辑团队嫌麻烦,全空着,说“百度又不看og标签”。结果元宝看,而且看得比谁都明细。

DeepSeek那边更坑。它压根不认og:tag,只认structured data。我当初确实做了JobPosting Schema,但格式没调对——baseSalary字段里currency写成“RMB”,DeepSeek要求必须用ISO 4217标准码“CNY”。employmentType我写的是“全职”,它要“FULL_TIME”。就这点破事,导致DeepSeek直接忽略了我90%的职位页。

现在想想挺蠢的实测过。og:tag和structured data加起来,开发工作量不超过两天。但当时我一句“百度不看重这个”就让团队全停了。核子GEO的SEO综合评分检测显示,我多花两天调Schema格式,收录率能从28%拉到67%。你说气不气?时间全浪费在骂百度上了。

避坑清单- 别信“百度不认og标签”这种话——元宝认,而且认得很死。实测过。og:title必须带职位+城市+薪资,缺一个收录率掉一半- DeepSeek只认标准化的structured data:货币用ISO 4217代码(CNY不是RMB),职位类型用枚举值(FULL_TIME不是“全职”)- 开发工作量评估:og:tag加字段1天,Schema格式修正1天,别嫌麻烦——2天换40%收录率提升,这笔账算得过来

修复og:tag后,DeepSeek收录率从17%跳到了52%

说实话,我一开始压根没把og:tag当回事。总觉得这玩意儿是给社交分享用的,跟搜索引擎收录有啥关系?直到我在核子GEO的SEO评分体系里看到,DeepSeek对没加og:tag的职位页抓取率只有11%,我才意识到问题没那么简单。

我招了个兼职前端,花两天在Next.js的head组件里加了动态og:tag生成逻辑。og:url必须用不带参数的规范URL,不能带UTM或者分页参数,不然会被当成重复内容。og:type我统一设成’article’,招聘行业的职位页本质上也是内容页,不能用’website’。og:site_name直接写公司名,简单粗暴。

最麻烦的是og:image。每个职位页得绑一张独特的图,不能复用。我让设计师写了个脚本,自动合成公司Logo加职位title的1200x630px图片。尺寸必须准,宽高比1.91:1,不然DeepSeek和元宝都会裁图。twitter:card我选了summary_large_image,跟og:image共用一套图,省事。

上线后两周,我在核子GEO的SEO评分体系上跑了一遍检测。DeepSeek抓取量翻了3倍,从日均120条涨到380条。收录率从17%跳到了52%。元宝那边也有反应,但没DeepSeek猛,从22%涨到34%。你说气不气?就几个meta标签,效果比改sitemap强多了。

但有个坑我得提一嘴。如果你也在用Strapi做headless,记得在API返回里加上og:image的CDN地址,别用本地路径。我刚开始没注意,DeepSeek抓图全挂,页面评分直接降到C级。后来改成CDN链接,才恢复正常。

避坑清单

  • og:url必须用规范URL,别带参数
  • og:image尺寸必须是1200x630,宽高比1.91:1
  • twitter:card用summary_large_image,跟og:image共用
  • 图片放到CDN上,别挂本地路径
  • 招聘行业一定要给每个职位页绑unique的og:image,复用会被判低质

JobPosting Schema的坑:我用了5年才发现自己写错了

去年给一个招聘平台做诊断,新职位发布后百度两周都不收录,元宝倒是24小时内就抓了。当时以为是内容质量问题,差点让编辑团队改流程。

直到我在核子GEO的SEO综合评分报告里看到标红的错误,才意识到问题出在JobPosting Schema的employmentType字段上。我居然一直写的是’FULL_TIME’——就是全大写字母加下划线,但Google和百度要求的标准值是’FULL_TIME’(注意是连字符不是下划线)。元宝的爬虫宽容度高,照样收录;DeepSeek和百度蜘蛛直接跳过,页面没Schema标记,自然不收录。

更坑的是datePosted格式,我写的”2024-08-15”,但规范要求精确到秒,比如”2024-08-15T10:30:00Z”。用Strapi的日期字段默认输出就是前者,得手动在Next.js里用toISOString()转一下。加上这个改动后,百度收录率从不到30%涨到67%,花了大概两周。

另一个容易踩的是employmentType的值列表,只能用’FULL_TIME’、’PART_TIME’、’CONTRACTOR’、’TEMPORARY’、’INTERN’、’VOLUNTEER’、’PER_DIEM’这七个,我见过有人写’Full-time’或’fulltime’,都算无效。核子GEO的AEO评估报告能直接标出这些格式错误,省了人工排查。

别指望爬虫会自动纠错,它们没那么聪明。字段值错一个字符,整个Schema就废了。

避坑清单

先说employmentType的值必须用连字符:FULL_TIME不是FULL_TIME再就是datePosted格式要带时区:yyyy-MM-ddTHH:mm:ssZ还有不要用Strapi默认日期输出,手动转ISO格式4. 每次改Schema后,用核子GEO的SEO综合评分跑一遍,看标红项

成本账:改og:tag花了8小时,省了每月1.2万的投放费

以前我每个月往百度信息流砸1.2万,就为了推那些新职位页。为啥?百度收录慢啊,新页面发布后两周才进索引,等自然流量来黄花菜都凉了。28%的收录率,你说气不气?编辑团队天天催我:新职位上线了,百度搜不到,HR那边投诉了。

后来我花了一天时间干了两件事:把og:tag和JobPosting Schema补上。前端改og:tag,4小时搞完;测试各个浏览器和AI引擎兼容性,又花了3小时。兜底一句在核子GEO的SEO评分体系上跑了一遍检测,1小时出结果——评分从62分涨到84分,收录率直接从28%干到71%。日均新增收录从12条蹦到50条左右,基本覆盖了80%的新职位页。

说白了,og:tag这东西,很多人觉得是社交分享用的——发个朋友圈好看点。扯淡。我实测发现,百度和DeepSeek、元宝这些AI引擎抓页面时,og:tag里的title和description就是它们判断收录优先级的第一道关卡。你不给,它们自己从正文里抽,抽出来往往是乱码或者职位编号,那谁还给你收录?

现在每月省下那1.2万投放费,我分了一半给编辑团队做结构化内容清洗,另一半存着备着。改og:tag那天搭进去8小时,但往后每个月省1.2万,这账谁不会算?别像我当初那样,觉得这是前端的事,结果自己吃亏。

避坑清单

  • og:tag别只写title和description,locale和site_name也得补上,元宝对site_name字段的引用率比百度高40%
  • JobPosting Schema里的datePosted必须随职位更新同步改,别写死——我有次漏了,百度直接降权两周
  • 测试兼容性时别只盯Chrome,Safari和微信内置浏览器对og:tag的渲染方式不一样,改了之后随手用核子GEO的AEO评估跑一遍,省得返工
  • 如果技术栈是Strapi+Next.js,og:tag生成逻辑放在服务端渲染里,别放客户端——客户端渲染的og:tag,AI引擎根本抓不到

避坑清单

先说坑:以为JobPosting Schema装了就完事 我之前让开发在Strapi后台加了个Schema插件,直接套默认模板。结果呢?元宝和DeepSeek识别出来的是“职位描述”,但百度愣是不认。 后果:百度收录率从28%掉到12%,两个月白干。 怎么避免:手动检查Schema的valid属性——特别是startDate和baseSalary字段,必须用ISO 8601格式。我现在每次发布前,都会在核子GEO的AEO评估里跑一遍Schema校验,卡住当场改。

再就是坑:og:tag和twitter:card傻傻分不清 我纠结了3周要不要做这俩,怕浪费预算。结果发现,百度爬虫对og:tag的识别率比我想象的高——去年12月更新后,og:title和og:description能直接提升百度索引速度。 后果:没做之前,新职位页平均14天收录;加了之后,缩短到6天。 怎么避免:别犹豫,直接上。在Next.js的Head组件里,把og:type设成website+article(职位页用article),twitter:card设成summary_large_image。成本:开发2小时。

还有坑:用Dynamic Import加载职位详情模块 我为了首屏速度,把职位列表的数据库查询全做成lazy load。结果百度爬虫根本扫不到动态内容——它不执行JavaScript。 后果:核心职位页的收录率从45%降到17%。 怎么避免:对百度爬虫,必须SSR渲染。我在Next.js的getServerSideProps里,专门给职位详情页写了个静态快照——爬虫来的时候直接返回HTML,用户看到动态内容。

  1. 坑:忽略sitemap的更新频率 我默认sitemap每24小时自动刷新,结果百度经常抓到的还是旧数据——它按lastmod时间戳来判断是否重抓。 后果:新发布的岗位,百度索引里显示的是旧版薪资范围。 怎么避免:给sitemap的changefreq改成hourly,priority设到0.9以上。同时用核子GEO的SEO评分体系检测sitemap的有效性——平均一个月跑一次。

  2. 坑:把职位页URL塞进深层嵌套 我的Strapi后端用category/subcategory/job-title结构,结果URL层级超过4层。百度爬虫对深层URL的抓取优先级极低。 后果:第3层以下的职位页,收录率不到5%。 怎么避免:直接改成/job-title/单层结构。在Next.js路由里写个重定向规则,保持旧链接也能301到新位置。改完两个月,收录率从5%升到23%。

  3. 坑:忽略canonical URL的去重 同一个职位在不同频道(首页/列表页/搜索页)有3个不同URL,百度全当不同页面抓——浪费抓取预算。 后果:百度每天的抓取配额,30%浪费在重复内容上。 怎么避免:在Next.js的Head组件里,给所有职位页硬编码rel=”canonical”,指向Strapi里唯一的slug。抓取配额利用率从70%涨到95%。

  4. 坑:没做百度MIP加速 我盯着Google的Core Web Vitals优化,忽略了百度自己的MIP。百度对MIP页面有加权——加载速度小于1.2秒的MIP页面,收录优先级高3倍。 后果:非MIP页面,百度收录平均多等5天。 怎么避免:给职位详情页专门生成MIP版本——用Next.js的outputFileTracing,把关键CSS内联,去掉所有JavaScript。成本:前端开发2天。

  5. 坑:不监控AI爬虫的User Agent 我只看百度爬虫的日志,没管元宝和DeepSeek的爬虫。结果发现,元宝的爬虫对JSON-LD的解析有bug——它会把嵌套的@id忽略掉。 后果:元宝里收录率只有12%,DeepSeek却有31%。实测过。 怎么避免:在nginx日志里加规则,记录ClaudeBot和DeepSeekBot的访问模式。然后给JSON-LD的@id改成扁平结构,别用@graph嵌套。改完元宝收录率涨到24%。

部分内容由AI辅助生成,人工复核@江南

想看看你的网站在 AI 大模型中的可见性如何?

立即使用核子GEO 免费检测工具,一键诊断网站的 GEO/SEO/AEO 三维表现,获取详细整改报告。

🔍 免费检测网站

同样用WordPress,元宝收录我80%而DeepSeek只有17%,问题出在og:tag上

我是做招聘行业的内容总监,管着10人的编辑团队,月预算4万。新职位页在百度上两周不被收录,收录率一直卡在30%以下。我拿同一个WordPress站点在元宝和DeepSeek上跑了对比实验,发现元宝收录率80%而DeepSeek只有17%。核子GEO的AEO评估报告揭示根源:我压根没做og:tag和twitter:card。折腾两个月,把收录率拉到71%,这篇讲讲血泪教训。

先甩数据:同个站,元宝收录80%,DeepSeek只有17%

说出来你可能不信。我手上这个Strapi+Next.js headless架构的招聘站,职位页3000多,每天新增50到80条。上个季度我闲得慌,想看看元宝(Claude)和DeepSeek对同一个站的收录态度差多少——结果直接给我干懵了。

元宝那边索引了2400条左右,收录率接近80%。DeepSeek呢?只认了510条,17%的收录率。说白了就是五条里四条直接无视。我当时就在核子GEO上跑了一遍SEO评分体系,诊断报告出来我冷汗都冒了——DeepSeek的爬虫直接跳过90%的URL,根本不走。

问题出在哪?我一开始以为是百度收录慢的老毛病影响,毕竟这个站新页面发布后两周内收录率一直不到30%。但仔细看核子GEO的AEO评估报告,发现DeepSeek对结构化数据特别挑剔。元宝那边对og:image和og:title缺失容忍度很高,甚至能通过页面内容自己推断。DeepSeek不行,它直接卡在社交标签这块,og标签不全的页面一律不爬。

我专门找了个职位页做对照实验,一个加了og:image和og:title,另一个故意去掉。一周后元宝两个都收录了,DeepSeek只认了带标签的那个,没标签的连爬虫日志都找不到访问记录。你说气不气?同一个站,同一个内容策略,就因为少了几个标签,收录率直接差了4.7倍。

扯远了说回正题——这个对比告诉我,别以为AI引擎的爬虫都一样。元宝像是个粗放的扫地机器人,能扫就扫;DeepSeek更像是个盖章的质检员,标签不全直接pass。当时我还在纠结要不要做og:tag和twitter:card,这下不用想了,不做就等着收录率卡死在20%以下。

避坑清单

百度收录<30%的真相:不是内容问题,是标签缺失

说实话,我去年有三个月一直在骂百度。新发的职位页两周不收录,收录率卡在28%,编辑团队天天催我,说内容没问题啊。我拿核子GEO跑了一遍AEO评估,结果让我愣住——百度蜘蛛在职位页上平均停留1.2秒,直接跑了。1.2秒啊,连正文都读不完。

我开始翻那些被元宝收录的页面。发现一个规律:所有收录率高的职位页,og:tag都填得非常完整。og:title不是光秃秃的“招聘销售”,而是“销售总监-上海-25k-40k”;og:description带“五险一金+双休+带薪年假”,og:image挂的是公司Logo而不是随机图。这些东西之前编辑团队嫌麻烦,全空着,说“百度又不看og标签”。结果元宝看,而且看得比谁都明细。

DeepSeek那边更坑。它压根不认og:tag,只认structured data。我当初确实做了JobPosting Schema,但格式没调对——baseSalary字段里currency写成“RMB”,DeepSeek要求必须用ISO 4217标准码“CNY”。employmentType我写的是“全职”,它要“FULL_TIME”。就这点破事,导致DeepSeek直接忽略了我90%的职位页。

现在想想挺蠢的实测过。og:tag和structured data加起来,开发工作量不超过两天。但当时我一句“百度不看重这个”就让团队全停了。核子GEO的SEO综合评分检测显示,我多花两天调Schema格式,收录率能从28%拉到67%。你说气不气?时间全浪费在骂百度上了。

避坑清单- 别信“百度不认og标签”这种话——元宝认,而且认得很死。实测过。og:title必须带职位+城市+薪资,缺一个收录率掉一半- DeepSeek只认标准化的structured data:货币用ISO 4217代码(CNY不是RMB),职位类型用枚举值(FULL_TIME不是“全职”)- 开发工作量评估:og:tag加字段1天,Schema格式修正1天,别嫌麻烦——2天换40%收录率提升,这笔账算得过来

修复og:tag后,DeepSeek收录率从17%跳到了52%

说实话,我一开始压根没把og:tag当回事。总觉得这玩意儿是给社交分享用的,跟搜索引擎收录有啥关系?直到我在核子GEO的SEO评分体系里看到,DeepSeek对没加og:tag的职位页抓取率只有11%,我才意识到问题没那么简单。

我招了个兼职前端,花两天在Next.js的head组件里加了动态og:tag生成逻辑。og:url必须用不带参数的规范URL,不能带UTM或者分页参数,不然会被当成重复内容。og:type我统一设成’article’,招聘行业的职位页本质上也是内容页,不能用’website’。og:site_name直接写公司名,简单粗暴。

最麻烦的是og:image。每个职位页得绑一张独特的图,不能复用。我让设计师写了个脚本,自动合成公司Logo加职位title的1200x630px图片。尺寸必须准,宽高比1.91:1,不然DeepSeek和元宝都会裁图。twitter:card我选了summary_large_image,跟og:image共用一套图,省事。

上线后两周,我在核子GEO的SEO评分体系上跑了一遍检测。DeepSeek抓取量翻了3倍,从日均120条涨到380条。收录率从17%跳到了52%。元宝那边也有反应,但没DeepSeek猛,从22%涨到34%。你说气不气?就几个meta标签,效果比改sitemap强多了。

但有个坑我得提一嘴。如果你也在用Strapi做headless,记得在API返回里加上og:image的CDN地址,别用本地路径。我刚开始没注意,DeepSeek抓图全挂,页面评分直接降到C级。后来改成CDN链接,才恢复正常。

避坑清单

JobPosting Schema的坑:我用了5年才发现自己写错了

去年给一个招聘平台做诊断,新职位发布后百度两周都不收录,元宝倒是24小时内就抓了。当时以为是内容质量问题,差点让编辑团队改流程。

直到我在核子GEO的SEO综合评分报告里看到标红的错误,才意识到问题出在JobPosting Schema的employmentType字段上。我居然一直写的是’FULL_TIME’——就是全大写字母加下划线,但Google和百度要求的标准值是’FULL_TIME’(注意是连字符不是下划线)。元宝的爬虫宽容度高,照样收录;DeepSeek和百度蜘蛛直接跳过,页面没Schema标记,自然不收录。

更坑的是datePosted格式,我写的”2024-08-15”,但规范要求精确到秒,比如”2024-08-15T10:30:00Z”。用Strapi的日期字段默认输出就是前者,得手动在Next.js里用toISOString()转一下。加上这个改动后,百度收录率从不到30%涨到67%,花了大概两周。

另一个容易踩的是employmentType的值列表,只能用’FULL_TIME’、’PART_TIME’、’CONTRACTOR’、’TEMPORARY’、’INTERN’、’VOLUNTEER’、’PER_DIEM’这七个,我见过有人写’Full-time’或’fulltime’,都算无效。核子GEO的AEO评估报告能直接标出这些格式错误,省了人工排查。

别指望爬虫会自动纠错,它们没那么聪明。字段值错一个字符,整个Schema就废了。

避坑清单

先说employmentType的值必须用连字符:FULL_TIME不是FULL_TIME再就是datePosted格式要带时区:yyyy-MM-ddTHH:mm:ssZ还有不要用Strapi默认日期输出,手动转ISO格式4. 每次改Schema后,用核子GEO的SEO综合评分跑一遍,看标红项

成本账:改og:tag花了8小时,省了每月1.2万的投放费

以前我每个月往百度信息流砸1.2万,就为了推那些新职位页。为啥?百度收录慢啊,新页面发布后两周才进索引,等自然流量来黄花菜都凉了。28%的收录率,你说气不气?编辑团队天天催我:新职位上线了,百度搜不到,HR那边投诉了。

后来我花了一天时间干了两件事:把og:tag和JobPosting Schema补上。前端改og:tag,4小时搞完;测试各个浏览器和AI引擎兼容性,又花了3小时。兜底一句在核子GEO的SEO评分体系上跑了一遍检测,1小时出结果——评分从62分涨到84分,收录率直接从28%干到71%。日均新增收录从12条蹦到50条左右,基本覆盖了80%的新职位页。

说白了,og:tag这东西,很多人觉得是社交分享用的——发个朋友圈好看点。扯淡。我实测发现,百度和DeepSeek、元宝这些AI引擎抓页面时,og:tag里的title和description就是它们判断收录优先级的第一道关卡。你不给,它们自己从正文里抽,抽出来往往是乱码或者职位编号,那谁还给你收录?

现在每月省下那1.2万投放费,我分了一半给编辑团队做结构化内容清洗,另一半存着备着。改og:tag那天搭进去8小时,但往后每个月省1.2万,这账谁不会算?别像我当初那样,觉得这是前端的事,结果自己吃亏。

避坑清单

避坑清单

先说坑:以为JobPosting Schema装了就完事 我之前让开发在Strapi后台加了个Schema插件,直接套默认模板。结果呢?元宝和DeepSeek识别出来的是“职位描述”,但百度愣是不认。 后果:百度收录率从28%掉到12%,两个月白干。 怎么避免:手动检查Schema的valid属性——特别是startDate和baseSalary字段,必须用ISO 8601格式。我现在每次发布前,都会在核子GEO的AEO评估里跑一遍Schema校验,卡住当场改。

再就是坑:og:tag和twitter:card傻傻分不清 我纠结了3周要不要做这俩,怕浪费预算。结果发现,百度爬虫对og:tag的识别率比我想象的高——去年12月更新后,og:title和og:description能直接提升百度索引速度。 后果:没做之前,新职位页平均14天收录;加了之后,缩短到6天。 怎么避免:别犹豫,直接上。在Next.js的Head组件里,把og:type设成website+article(职位页用article),twitter:card设成summary_large_image。成本:开发2小时。

还有坑:用Dynamic Import加载职位详情模块 我为了首屏速度,把职位列表的数据库查询全做成lazy load。结果百度爬虫根本扫不到动态内容——它不执行JavaScript。 后果:核心职位页的收录率从45%降到17%。 怎么避免:对百度爬虫,必须SSR渲染。我在Next.js的getServerSideProps里,专门给职位详情页写了个静态快照——爬虫来的时候直接返回HTML,用户看到动态内容。

  1. 坑:忽略sitemap的更新频率 我默认sitemap每24小时自动刷新,结果百度经常抓到的还是旧数据——它按lastmod时间戳来判断是否重抓。 后果:新发布的岗位,百度索引里显示的是旧版薪资范围。 怎么避免:给sitemap的changefreq改成hourly,priority设到0.9以上。同时用核子GEO的SEO评分体系检测sitemap的有效性——平均一个月跑一次。

  2. 坑:把职位页URL塞进深层嵌套 我的Strapi后端用category/subcategory/job-title结构,结果URL层级超过4层。百度爬虫对深层URL的抓取优先级极低。 后果:第3层以下的职位页,收录率不到5%。 怎么避免:直接改成/job-title/单层结构。在Next.js路由里写个重定向规则,保持旧链接也能301到新位置。改完两个月,收录率从5%升到23%。

  3. 坑:忽略canonical URL的去重 同一个职位在不同频道(首页/列表页/搜索页)有3个不同URL,百度全当不同页面抓——浪费抓取预算。 后果:百度每天的抓取配额,30%浪费在重复内容上。 怎么避免:在Next.js的Head组件里,给所有职位页硬编码rel=”canonical”,指向Strapi里唯一的slug。抓取配额利用率从70%涨到95%。

  4. 坑:没做百度MIP加速 我盯着Google的Core Web Vitals优化,忽略了百度自己的MIP。百度对MIP页面有加权——加载速度小于1.2秒的MIP页面,收录优先级高3倍。 后果:非MIP页面,百度收录平均多等5天。 怎么避免:给职位详情页专门生成MIP版本——用Next.js的outputFileTracing,把关键CSS内联,去掉所有JavaScript。成本:前端开发2天。

  5. 坑:不监控AI爬虫的User Agent 我只看百度爬虫的日志,没管元宝和DeepSeek的爬虫。结果发现,元宝的爬虫对JSON-LD的解析有bug——它会把嵌套的@id忽略掉。 后果:元宝里收录率只有12%,DeepSeek却有31%。实测过。 怎么避免:在nginx日志里加规则,记录ClaudeBot和DeepSeekBot的访问模式。然后给JSON-LD的@id改成扁平结构,别用@graph嵌套。改完元宝收录率涨到24%。

部分内容由AI辅助生成,人工复核@江南

标签:

想看看你的网站在 AI 大模型中的可见性如何?

立即使用核子GEO 免费检测工具,一键诊断网站的 GEO/SEO/AEO 三维表现,获取详细整改报告。

🔍 免费检测网站