页面搜不到,通常是抓取问题而不是内容问题
我的页面几乎都搜不到。我以为是内容太少——这个判断对吗?
这个现象由哪些检查暴露
- robots-blocks-important —— robots 规则挡住了你明显想收录的路径
- robots-unreachable —— robots 文件返回错误,规则等于未知
- sitemap-coverage —— sitemap 没有列出本应可被发现的页面
- orphan-pages —— 没有任何站内链接指向的页面
- deep-pages —— 距首页点击次数过深、很少被走到的页面
对应检查项:robots-blocks-important · robots-unreachable · sitemap-coverage · orphan-pages · deep-pages
一个具体例子
多年前为拦截测试目录写的 Disallow 规则,可能挡住你后来搬进去的正式栏目。页面在浏览器里照常打开,所以看不出哪里坏了。
FAQ
- 没有 Search Console 怎么查?
- 爬一遍站就能看出哪些页面可达、哪些被挡,以及每个页面是否有站内链接指向——上述四类原因都能覆盖。
- 要不要先多发一些页面?
- 对已有页面没有帮助。抓取被挡住时,新页面会继承同一个问题。