第 1 步:先在 GSC 打开“网址检查”
进入 GSC 后,在顶部的“检查任何网址”输入框粘贴完整页面 URL。不要只输入域名,也不要漏掉目录和末尾斜杠。
检查结果会告诉你“网址是否在 Google 中”。如果已编入索引,问题可能是你用 site: 搜索没有看到,或页面暂时没有获得排名;如果未编入索引,再继续往下查原因。
第 2 步:页面本身能不能正常打开?
用无痕窗口打开 URL。重要页面应正常显示,并返回 200 状态;如果跳到别的地址、显示 404、要求登录或服务器报错,Google 也很难正确收录。
新页面不要先做成只有一句话的空壳。它至少应该能完整回答一个具体问题,并且有清楚标题和正文。
第 3 步:有没有被 noindex 挡住?
noindex 的意思是明确告诉搜索引擎“不要把这个页面放进索引”。它常见于测试页、感谢页、筛选页;但如果不小心放在产品页或文章页,就会导致不收录。
如果你使用 SEO 插件,在页面编辑页和插件的高级设置里检查;也可以在 URL 检查报告里看 Google 是否提示“被 noindex 标记排除”。
第 4 步:robots.txt 有没有阻止?
robots.txt 是给抓取程序的规则文件。它常用于阻止后台、测试目录或不重要的筛选页;但如果误把正式内容目录挡住,Google 就不会正常抓取。URL 检查报告会显示 Google 是否允许抓取。
第 5 步:Canonical 指向哪里?
Canonical 可以理解成“这几个相似页面里,哪个才是主页面”。如果一篇文章的 Canonical 指向了别的 URL,Google 可能不会把当前 URL 单独收录。先检查它是否指向本页;如果确实是重复页,再保留正确主页面即可。
第 6 步:Google 有没有发现这个页面?
新页面最好同时有三个入口:站点地图、正文内链、清楚的网站结构。只把 URL 发到朋友圈或藏在后台,不代表 Google 一定能发现。
- 把重要 URL 放进正确的 Sitemap。
- 在一篇相关旧文章中,用自然的文字链接到新页面。
- 确认导航或分类结构能帮助用户和 Google 找到它。
第 7 步:两种常见状态分别怎么办?
Crawled – currently not indexed
意思是 Google 已经访问过页面,但目前没有把它放进索引。先检查它是否和别的页面重复、是否内容太少、是否没有清楚主题、是否只是换了几个词的相似页面。不要只靠重复提交。
Discovered – currently not indexed
意思是 Google 知道这个 URL,但还没有抓取。先检查服务器稳定性、内链、站点地图、网站规模和页面优先级。新站或大量新增页面时,这种状态并不少见。
什么时候可以请求编入索引?
当你已经修复明显问题、页面内容完整、内部链接和 Sitemap 都准备好后,可以在 URL 检查页面点击“请求编入索引”。把它当作提醒 Google 重新检查,而不是加速排名按钮。
不收录排查清单
- URL 能正常打开,状态不是 404、跳转或服务器错误。
- 正式页面没有 noindex。
- robots.txt 没有阻止抓取。
- Canonical 没有错误指向其它页面。
- 页面有内链、Sitemap 入口和完整内容。
- 看清 GSC 的具体状态后再决定是否提交。
