资源 · 31
诊断有用页面的抓取和索引情况。
在修复问题之前,关联链接、HTTP 响应、指令、规范链接和 Search Console 中的证据。
已更新 · 2 min
本指南有助于实现的目标
- 选择有用页面。
- 测试发现问题。
- 诊断差距。
- 重新测试。
快速检查
- HTML 链接能否到达页面?
- 访客和爬虫会收到什么响应?
- robots、noindex 和 canonical 信号是否一致?
- 页面是否提供独特的价值?
- 修复后 URL 检查结果如何?
分步指南
- 1
选择优先级集
列出重要 URL 及其意图、首选 canonical 和实际最后更改时间。 排除过滤器和没有独立价值的页面。
交付成果:每个 URL 的优先级清单和假设。
- 2
测试发现路径
跟踪入口页面的 HTML 链接,并将其与站点地图进行比较。 站点地图中的 URL 可能仍然未被抓取或索引。
交付成果:路径、孤立页面和站点地图空白。
- 3
检查响应
验证 HTTP 状态、重定向、可用性、渲染和必要资源。 分别检查 robots 规则和 noindex 指令。
交付成果:响应和指令记录。
- 4
检查规范选择
比较已声明的规范链接、内部链接、站点地图以及搜索引擎选择的页面。 规范偏好是一种信号,而非绝对命令。
交付成果:版本聚类和矛盾之处。
- 5
整合观察结果
比较索引报告、URL 检查和服务器日志(如有)。 区分发现、抓取、渲染、规范选择和索引过程。
交付成果:带有置信度的诊断日期。
- 6
修复和验证
修复已识别的原因,重新测试页面及其链接,提交有效的更改并监控其进展。 不要承诺索引截止日期。
交付成果:修复证据和后续跟进。
管理指标
| 指标 | 衡量内容 | 首要行动 |
|---|---|---|
| 发现 | 通过 HTML 链接访问的优先级 URL | 修复架构 |
| 响应 | 具有预期可访问状态的优先级 URL | 修复服务器和重定向 |
| 一致性 | 规范、站点地图和指令对齐 | 解决矛盾 |
| 后续跟进 | 记录原因并重新测试修复 | 重新审视未经证实的案例 |
常见错误
- 将站点地图包含视为索引保证
- 阻止机器人访问必须读取 noindex 的页面
- 未审查变体就大规模更改规范链接
- 未评估内容就将所有问题归咎于技术
常见问题解答
站点地图是否强制索引?
否。它可以帮助发现网站,但既不能保证抓取,也不能保证索引。
声明的规范链接对 Google 是否具有约束力?
它表达了一种偏好;Google 可能会根据观察到的信号选择其他版本。
何时确认修复?
在检查了可能的原因、部署了修复程序并在适当的时间内检查了证据之后。
官方参考文献
参考文献支持该方法。 请根据您的实际情况调整检查;它们并非认证。 原始参考文献标题和源文档可能使用其他语言。






