首页排行榜报告列表文章标签AI时代SEO整站测评抓取失败关于

sohu.com

核子GEO 综合评估报告 · 评级 D+ · 2026-07-24 23:15:18

📅 2026-07-24 23:15:18 📊 历史记录 🔬 对比同行
35.0
/ 100
综合评分
D+
31.6
/ 100
AEO · AI引擎优化
22.6
/ 100
GEO · 生成式引擎优化
59.2
/ 100
SEO · 搜索引擎优化
47.0
/ 100
语义质量 · AI理解度
9.6
/ 100
权威度 · E-E-A-T
31.4
/ 100
语料库 · AI引用价值

🎯 关键发现

TL;DR

不想看长篇报告?这里有sohu.com的核心结论:

  • 🚨 综合表现较弱,sohu.com 在AI大模型和搜索引擎中的可见性堪忧,急需整改
  • 🚨 最严重问题:权威度 仅 10 分 — 添加作者署名和资质标识、获取权威外链和百科收录
  • 🔥 4 个维度低于40分,建议立即修复:AEO、GEO、权威度、语料库
👇 想知道具体哪里有问题?查看详细分析 · 查看行动清单

📖 六维度解读 — 你的网站表现如何?

每个维度的分数代表什么?对你的网站意味着什么?以下是通俗易懂的解读:

AEO 32/100
AI引擎可见性
网站在ChatGPT、DeepSeek、文心一言等AI大模型中能否被发现和引用
较弱,急需改进
配置robots.txt允许AI爬虫、创建llms.txt、完善JSON-LD结构化数据
GEO 23/100
生成式引擎优化
网站内容对AI爬虫的友好程度,含结构化数据、语义清晰度、可信度
较弱,急需改进
提升内容语义结构化、添加作者信息和备案号、增加社交证明
SEO 59/100
搜索引擎优化
网站在百度、Google等传统搜索引擎中的排名表现和技术合规性
一般,存在明显短板
优化title/meta描述、完善图片alt、提升页面加载速度
语义质量 47/100
AI理解度
AI模型能否准确理解页面内容的语义价值,含内容深度、信息密度
一般,存在明显短板
增加内容深度和数据点、提升主题一致性、使用问答结构
权威度 10/100
E-E-A-T
AI系统如何判定网站的专家性、权威性和可信度
较弱,急需改进
添加作者署名和资质标识、获取权威外链和百科收录
语料库 31/100
AI引用价值
网站被AI大模型视为高质量训练/引用语料的概率
较弱,急需改进
提升机器可读性、添加更多Schema标记、配置AI爬虫友好策略
🤔 不确定怎么改?查看下方行动清单,按优先级逐项修复 ↓
接下来,让我们看看 AI大模型能否访问你的网站

🌐 网站概览

这个网站是干嘛的?

页面标题: 搜狐

meta描述: 搜狐网为用户提供24小时不间断的最新资讯,及搜索、邮件等网络服务。内容包括全球热点事件、突发新闻、时事评论、热播影视剧、体育赛事、行业动态、生活服务信息,以及论坛、博客、微博、我的搜狐等互动空间。

关键词: 搜狐,门户网站,新媒体,网络媒体,新闻,财经,体育,娱乐,时尚,汽车,房产,科技,图片,论坛,微博,博客,视频,电影,电视剧

导航栏目: 新闻 | 军事 | 专题 | 财经 | 宏观 | 理财 | 体育 | 世界杯

页面内容预览 (前400字):

关闭皮肤 搜狐首页 搜狐号 时间线 网络监督专区欢迎监督如实举报 学习强国 伟大的变革 社会主义核心价值观 网上有害信息举报专区 两枚菲尔兹奖背后 中国数学走了多远? 台风“红霞”来袭 预计影响36座机场 美伊互袭持续 霍尔木兹海峡仍是博弈重点 苏州试点骑手等红灯不扣配送时长 委内瑞拉震后一个月:重建房子和安全感 西班牙法国意大利 野火肆虐欧洲多国 克洛普出任德国男足国家队主教练 视频 跟着镜头一起来看绝美的星空 热 门 | 三伏晒背别乱晒! 推 荐 | 高血压对身体有什么危害? 看 点 | 中国传统色|邂逅一场浪漫的东方美学 狐厂大拷问 第五立面 热 播 | 种墨园 扁豆爱焖面 战火 九个弹孔 自 制 | 逆光告白 隐私 请君入梦 假面迷情 电 影 | 终结者 疯狂动物城 六小时 萨利 动 漫 | 空心捣蛋团 小马宝莉 猫和老鼠 综 艺 | 星同事 爱情保卫战 谢谢你来了 “义乌发展经验

⚠️ 抓取到的页面可见文字较少(400字,HTML 总长度 187741 字节)
可能原因:
- 该网站是 SPA(单页面应用),内容由 JavaScript 动态渲染,静态抓取拿不到
- 网站启用了反爬机制,返回了空壳页面
- 页面重度依赖 iframe 或异步加载

以下报告基于有限的静态 HTML 内容生成,评分可能偏低。

页面结构速览

| | 指标 | 当前值 | 标准值 | 状态 | |
|------|--------|--------|------|
| | H1标签 | 0 个 | 1 个 | ❌ H1数量不对 | |
| | H2标签 | 0 个 | >=2 个 | ❌ H2太少 | |
| | meta描述 | 98 字符 | >50 字符 | ✅ | |
| | 图片alt属性 | 12/12 | 全部 | ✅ | |
| | OpenGraph | 无 | 应有 | ❌ 没有OG标签 | |

📋 备案信息

❌ 缺少 ICP 备案号和公安备案号

在中国运营的网站,ICP 备案是法律强制要求。没有备案号不仅违法,
搜索引擎和 AI 也会将其视为信任信号缺失,影响权威性。

建议: 在页脚加上:

<a href="https://beian.miit.gov.cn/" target="_blank" rel="noopener">你的ICP备案号</a>
<a href="http://www.beian.gov.cn/" target="_blank" rel="noopener">你的公安备案号</a>

📝 网站真实代码(抓取自 https://sohu.com)

以下是从你网站 HTML 里提取的代码,供参考分析。

<head> 区域原始代码

&lt;head&gt;&lt;title&gt;搜狐&lt;/title&gt;&lt;meta content=&quot;搜狐,门户网站,新媒体,网络媒体,新闻,财经,体育,娱乐,时尚,汽车,房产,科技,图片,论坛,微博,博客,视频,电影,电视剧&quot; name=&quot;Keywords&quot;/&gt;&lt;meta content=&quot;搜狐网为用户提供24小时不间断的最新资讯,及搜索、邮件等网络服务。内容包括全球热点事件、突发新闻、时事评论、热播影视剧、体育赛事、行业动态、生活服务信息,以及论坛、博客、微博、我的搜狐等互动空间。&quot; name=&quot;Description&quot;/&gt;&lt;meta content=&quot;1237e4d02a3d8d73e96cbd97b699e9c3_1504254750&quot; name=&quot;shenma-site-verification&quot;/&gt;&lt;meta charset=&quot;utf-8&quot;/&gt;&lt;meta content=&quot;IE=edge&quot; http-equiv=&quot;X-UA-Compatible&quot;/&gt;&lt;meta content=&quot;on&quot; http-equiv=&quot;x-dns-prefetch-control&quot;/&gt;&lt;meta content=&quot;width=device-width,initial-scale=1,minimum-scale=1,user-scalable=yes,viewport-fit=cover&quot; name=&quot;viewport&quot;/&gt;&lt;meta content=&quot;smpc&quot; name=&quot;data-spm&quot;/&gt;&lt;meta content=&quot;always&quot; name=&quot;referrer&quot;/&gt;&lt;link href=&quot;//mp.sohu.com&quot; rel=&quot;dns-prefetch&quot;/&gt;&lt;link href=&quot;//zmt.itc.cn&quot; rel=&quot;dns-prefetch&quot;/&gt;&lt;link href=&quot;//statics.itc.cn

meta 标签

&lt;meta content=&quot;搜狐,门户网站,新媒体,网络媒体,新闻,财经,体育,娱乐,时尚,汽车,房产,科技,图片,论坛,微博,博客,视频,电影,电视剧&quot; name=&quot;Keywords&quot;/&gt;
&lt;meta content=&quot;搜狐网为用户提供24小时不间断的最新资讯,及搜索、邮件等网络服务。内容包括全球热点事件、突发新闻、时事评论、热播影视剧、体育赛事、行业动态、生活服务信息,以及论坛、博客、微博、我的搜狐等互动空间。&quot; name=&quot;Description&quot;/&gt;
&lt;meta content=&quot;1237e4d02a3d8d73e96cbd97b699e9c3_1504254750&quot; name=&quot;shenma-site-verification&quot;/&gt;
&lt;meta charset=&quot;utf-8&quot;/&gt;
&lt;meta content=&quot;IE=edge&quot; http-equiv=&quot;X-UA-Compatible&quot;/&gt;
&lt;meta content=&quot;on&quot; http-equiv=&quot;x-dns-prefetch-control&quot;/&gt;
&lt;meta content=&quot;width=device-width,initial-scale=1,minimum-scale=1,user-scalable=yes,viewport-fit=cover&quot; name=&quot;viewport&quot;/&gt;
&lt;meta content=&quot;smpc&quot; name=&quot;data-spm&quot;/&gt;

JSON-LD 结构化数据

❌ 缺少 JSON-LD 结构化数据! AI引擎无法理解页面内容结构。

建议至少添加一个 Organization 类型,代码如下:

<script type="application/ld+json">
{
  &quot;@context&quot;: &quot;https://schema.org&quot;,
  &quot;@type&quot;: &quot;Organization&quot;,
  &quot;name&quot;: &quot;搜狐&quot;,
  &quot;url&quot;: &quot;https://sohu.com&quot;,
  &quot;description&quot;: &quot;搜狐网为用户提供24小时不间断的最新资讯及搜索邮件等网络服务内容包括全球热点事件突发新闻时事评论热播影视剧体育赛事行业动态生活服务信息以及论坛博客微博我的搜狐等互动空间&quot;
}
</script>

H1 主标题

❌ 缺少 H1 标签! 搜索引擎和AI都无法确定页面的核心主题。

加上这个:

<h1>搜狐</h1>

H2 章节标题

❌ 缺少 H2 标签! 内容结构需要优化,建议添加章节标题。

<body> 区域开头

&lt;html&gt;&lt;body class=&quot;sohu-index-v3&quot; data-spm=&quot;home&quot; data-spm-ext=&quot;productId:1467;productType:13;categoryId:47;businessTemplateGroupId:110073;appCode:smpc;mediaId:121135924;pageId:1784906057608_nr8Xp_FkU&quot;&gt;&lt;header class=&quot;sohu-head&quot;&gt;&lt;div class=&quot;area sohu-head-box&quot;&gt;&lt;div class=&quot;right head-right&quot; id=&quot;topHead&quot;&gt;&lt;/div&gt;&lt;div class=&quot;right head-right&quot; id=&quot;loginBtn&quot;&gt;&lt;/div&gt;&lt;/div&gt;&lt;/header&gt;&lt;div class=&quot;theme-skin-wra

导航结构 <nav>

&lt;nav class=&quot;nav area&quot; data-spm=&quot;top-nav&quot;&gt; &lt;div class=&quot;box first&quot;&gt; &lt;a class=&quot;nav-item&quot; data-clev=&quot;10220218&quot; href=&quot;https://news.sohu.com/?pcm=202.412_0_0.0.0&amp;amp;scm=thor.412_14-201000.0.0-0-0-0-0.0&quot; target=&quot;_blank&quot;&gt;&lt;strong&gt;新闻&lt;/strong&gt;&lt;/a&gt; &lt;a class=&quot;nav-item 2&quot; data-clev=&quot;10220219&quot; href=&quot;https://mil.s

下面是每个维度的 详细检查项和具体得分,往下看找问题 ↓

📊 综合评分概览

| | 评估维度 | 权重 | 得分 | 评级 | 星级 | 锐评 | |
|----------|------|------|------|------|------|
| | AEO (AI引擎优化) | 25% | 31.6 | D+ | ★★★☆☆☆☆☆☆☆ | 需要重点改进,建议全面优化。… | |
| | GEO (生成式引擎优化) | 25% | 22.6 | D | ★★☆☆☆☆☆☆☆☆ | 需要重点改进,建议全面优化。… | |
| | SEO (搜索引擎优化) | 20% | 59.2 | C+ | ★★★★★☆☆☆☆☆ | 存在一些问题,建议针对性优化。… | |
| | 语义质量 (AI理解度) | 15% | 47.0 | C | ★★★★☆☆☆☆☆☆ | 存在一些问题,建议针对性优化。… | |
| | 权威度 (E-E-A-T) | 10% | 9.6 | D | ☆☆☆☆☆☆☆☆☆☆ | 基础薄弱,需要系统整改。… | |
| | 语料库 (AI引用价值) | 5% | 31.4 | D+ | ★★★☆☆☆☆☆☆☆ | 需要重点改进,建议全面优化。… | |

🎯 综合总评

  • 总分: 35.0 / 100
  • 评级: D+ (较差)
  • 星级: ★★★☆☆☆☆☆☆☆
  • 评分公式: AEO×25% + GEO×25% + SEO×20% + 语义质量×15% + 权威度×10% + 语料库×5%

需要重点改进,建议全面优化。

⚠️ 严重问题警告

该网站的 GEO/SEO 优化存在严重问题,建议立即整改。

⚠️ GEO (生成式引擎优化): 内容结构存在严重缺陷。缺少 H1、meta、OG 标签等基础配置,AI 爬虫抓取后难以理解页面内容。

📋 结论: 建议立即进行全面的 GEO/SEO 优化整改,以提升搜索可见度。


AEO分析完了,你的 生成式引擎优化(GEO) 表现如何?继续看 ↓

🔍 AEO评估结果 (AI引擎优化)

AEO (Answer Engine Optimization) 评估你的网站在 ChatGPT、Claude、Perplexity 等 AI 引擎中的可见性和可引用性。

AI爬虫访问 (权重: 20%)

得分: 31.2 / 100
状态: partial

抓取结果:

  • robots_url: https://sohu.com/robots.txt
  • content: User-agent: Baiduspider
    Disallow: /?
    Allow: /a/?
    Allow: /abroad_a/?
    Allow: /picture/?
    Allow: /_a(/qihoo_a)/?
    Allow: /collection/
    ?
    Allow: /ab_a/
    ?
    Allow: /classic
    ?
    Allow: /?
    $
    Allow: /n…
  • results: [{‘crawler’: ‘百度文心一言’, ‘description’: ‘百度搜索 + 文心大模型’, ‘agent’: ‘Baiduspider’, ‘allowed’: True}, {‘crawler’: ‘字节豆包’, ‘description’: ‘字节跳动/抖音/豆包AI’, ‘agent’: ‘Bytespider’, ‘allowed’: True}, {‘crawler’: ‘360AI’, ‘description’: ‘360搜索 + 360智脑’, ‘agent’: ‘360Spider’, ‘allowed’: True}, {‘crawler’: ‘搜狗’, ‘description’: ‘搜狗搜索 + 搜狗AI’, ‘agent’: ‘Sogou web spider’, ‘allowed’: True}, {‘crawler’: ‘神马’, ‘description’: ‘UC/神马搜索’, ‘agent’: ‘YisouSpider’, ‘allowed’: True}, {‘crawler’: ‘Kimi’, ‘description’: ‘月之暗面 Kimi’, ‘agent’: ‘KimiBot’, ‘allowed’: False}, {‘crawler’: ‘DeepSeek’, ‘description’: ‘深度求索 DeepSeek’, ‘agent’: ‘DeepSeekBot’, ‘allowed’: False}, {‘crawler’: ‘阿里通义千问’, ‘description’: ‘阿里巴巴通义千问’, ‘agent’: ‘TongyiBot’, ‘allowed’: False}, {‘crawler’: ‘腾讯混元’, ‘description’: ‘腾讯混元大模型’, ‘agent’: ‘TencentPR’, ‘allowed’: False}, {‘crawler’: ‘智谱ChatGLM’, ‘description’: ‘智谱AI ChatGLM’, ‘agent’: ‘ChatGLMBot’, ‘allowed’: False}, {‘crawler’: ‘讯飞星火’, ‘description’: ‘科大讯飞星火大模型’, ‘agent’: ‘iFlytekBot’, ‘allowed’: False}, {‘crawler’: ‘OpenAI’, ‘description’: ‘OpenAI GPT 系列’, ‘agent’: ‘GPTBot’, ‘allowed’: False}, {‘crawler’: ‘Anthropic’, ‘description’: ‘Anthropic Claude’, ‘agent’: ‘ClaudeBot’, ‘allowed’: False}, {‘crawler’: ‘Perplexity’, ‘description’: ‘Perplexity AI’, ‘agent’: ‘PerplexityBot’, ‘allowed’: False}, {‘crawler’: ‘Google AI’, ‘description’: ‘Google AI 扩展’, ‘agent’: ‘Google-Extended’, ‘allowed’: False}, {‘crawler’: ‘Common Crawl’, ‘description’: ‘Common Crawl 语料库’, ‘agent’: ‘CCBot’, ‘allowed’: False}]

评分原理: 百度文心一言(Baiduspider)、字节豆包(Bytespider)、Kimi(KimiBot)、DeepSeek等AI引擎使用专用爬虫抓取网页内容。通过robots.txt明确允许这些爬虫访问,您的知识才能被国内主流AI引用。

得分公式: 得分 = (允许的AI爬虫数量 / 总AI爬虫数量) × 100

整改方案:

被禁止的AI爬虫,在robots.txt中添加:

User-agent: Baiduspider
Allow: /

User-agent: Bytespider
Allow: /

User-agent: KimiBot
Allow: /

本检测由 GEO评估工具 提供,检测了 16 个国内外主流 AI 爬虫的访问权限。

发现的问题:

  • ❌ Kimi被禁止访问
  • ❌ DeepSeek被禁止访问
  • ❌ 阿里通义千问被禁止访问
  • ❌ 腾讯混元被禁止访问
  • ❌ 智谱ChatGLM被禁止访问
  • ❌ 讯飞星火被禁止访问
  • ❌ OpenAI被禁止访问
  • ❌ Anthropic被禁止访问
  • ❌ Perplexity被禁止访问
  • ❌ Google AI被禁止访问
  • ❌ Common Crawl被禁止访问

详细检查结果:

| | 爬虫名称 | 代理标识 | 是否允许 | |
|----------|----------|----------|
| | 百度文心一言 | Baiduspider | ✅ | |
| | 字节豆包 | Bytespider | ✅ | |
| | 360AI | 360Spider | ✅ | |
| | 搜狗 | Sogou web spider | ✅ | |
| | 神马 | YisouSpider | ✅ | |
| | Kimi | KimiBot | ❌ | |
| | DeepSeek | DeepSeekBot | ❌ | |
| | 阿里通义千问 | TongyiBot | ❌ | |
| | 腾讯混元 | TencentPR | ❌ | |
| | 智谱ChatGLM | ChatGLMBot | ❌ | |
| | 讯飞星火 | iFlytekBot | ❌ | |
| | OpenAI | GPTBot | ❌ | |
| | Anthropic | ClaudeBot | ❌ | |
| | Perplexity | PerplexityBot | ❌ | |
| | Google AI | Google-Extended | ❌ | |
| | Common Crawl | CCBot | ❌ | |


llms.txt配置 (权重: 15%)

得分: 40.0 / 100
状态: partial

抓取结果:

  • llms_url: https://sohu.com/llms.txt
  • status_code: 200
  • file_size: 8197
  • content_preview: <!DOCTYPE html>
404,您访问的页面已经不存在!
<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Organization",
  "name": "搜狐",
  "description": "搜狐网为用户提供24小时不间断的最新资讯,及搜索、邮件等网络服务。内容包括全球热点事件、突发新闻、时事评论、热播影视剧、体育赛事、行业动态、生活服务信息,以及论坛、博客、微博、我的搜狐等互动空间。",
  "url": "https://sohu.com"
}
</script>
<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Article",
  "headline": "搜狐",
  "author": {"@type": "Person", "name": "搜狐编辑团队"},
  "datePublished": "2026-07-24",
  "description": "搜狐网为用户提供24小时不间断的最新资讯,及搜索、邮件等网络服务。内容包括全球热点事件、突发新闻、时事评论、热播影视剧、体育赛事、行业动态、生活服务信息,以及论坛、博客、微博、我的搜狐等互动空间。"
}
</script>
<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "FAQPage",
  "mainEntity": [{
    "@type": "Question",
    "name": "关于搜狐的常见问题",
    "acceptedAnswer": {"@type": "Answer", "text": "这里填写针对该问题的详细回答"}
  }]
}
</script>
> 以上代码已根据 **sohu.com** 的实际标题和描述自动生成,直接复制到 `` 中即可。更多 Schema 类型(Product / LocalBusiness / VideoObject)可参考 [GEO评估工具](https://www.heezi.cn)。 **发现的问题**: - ❌ 页面缺少JSON-LD结构化数据 --- ### 内容可提取性 (权重: 18%) **得分**: 40.0 / 100 **状态**: partial **抓取结果**: - headers: {} - html_length: 54459 - has_lists: True - has_tables: False **评分原理**: AI引擎通过解析HTML结构来提取内容。清晰的标题层级、足够的内容长度、列表和表格等结构化元素,让AI更容易理解和提取您的内容。 **得分公式**: 得分 = (通过的检查项数量 / 5) × 100 **整改方案**: 1. 确保每个页面只有一个H1标签 2. 添加至少3个H2章节组织内容 3. 确保页面内容超过5000字符 4. 使用