google网站收录:改版或迁移时应核对什么
📍 WDQWDWQD987AAAAA:216.73.217.108
📱 Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; +claudebot@anthropic.com)
🔗 /52b2f225910c.html
📄
google网站收录:改版或迁移时应核对什么
改版或迁移后,Google 需要重新抓取并重新判断页面,收录会经历一段波动期。核对的重点不是“有没有立刻收录”,而是确认新 URL 可抓取、旧 URL 有正确去向、页面内容与信号没有被误伤。下面按观察、判断、处理、复查四步说明。
先观察:哪些页面掉出了收录
用 Google Search Console 的“页面”报告,对比改版前后的“已编入索引”数量,并逐类查看“已发现但未编入索引”“已抓取但未编入索引”“备用网页(有规范标签)”“已排除”等状态。不要只看总数,要按目录或模板分组,例如文章页、产品页、列表页分别统计,才能判断是全局问题还是局部问题。
再判断:常见原因分三类
- 抓取被挡:robots.txt 误屏蔽了新目录,或服务器对 Googlebot 返回 403、5xx。注意 robots.txt 的抓取限制不等于可靠的索引移除,它只阻止抓取,已收录页面仍可能留在索引中。
- 去向不清:旧 URL 没有做 301 到最相关的新 URL,而是跳到首页或返回 404、410,导致原有信号无法传递。
- 信号冲突:新页面 canonical 指向旧地址,或同时存在 www 与非 www、http 与 https 两套可访问版本,让 Google 无法确定哪个是规范页。
一项现象可能有多种解释。例如“已抓取但未编入索引”既可能是内容质量判断,也可能是重复页面或临时性波动,不能只凭一条报告就断定唯一原因。
处理:按优先级核对清单
- 确认 robots.txt 没有误封新路径,测试方法是在浏览器访问
/robots.txt,逐条核对 Disallow 规则。
- 为每个旧 URL 设置 301,指向内容最接近的新 URL;不要全部跳到首页。
- 检查新页面的 canonical 是否指向自身,且全站只有一种首选域名和协议版本。
- 更新并提交 XML 站点地图。站点地图不保证收录,它只是帮助发现 URL,不能替代内链和可抓取性。
- 核对分页、筛选参数和 hreflang,避免产生大量重复或错误指向。
- 检查 HTTPS 配置是否完整。HTTPS 不保证安全无漏洞或排名,它只是基础条件之一。
假设某站把 /old-a 迁到 /new-a,若 301 正确,复查时可在 Search Console 的 URL 检查工具中查看 Google 选择的规范页是否已变为 /new-a;若仍显示旧地址,说明信号尚未完全转移,需要继续观察。
复查:多久看一次,看什么
迁移后前两周可每 2–3 天查看一次抓取统计和索引状态,之后改为每周一次。重点看:新 URL 是否被选为规范页、旧 URL 是否逐渐退出索引、抓取请求是否返回 200、站点地图中已提交的 URL 是否被读取。不同搜索引擎支持情况须分别核查,这里只针对 Google 的抓取与索引报告。
下一步:打开 Search Console 的“页面”报告,导出“未编入索引”的 URL 列表,按上述三类原因逐条标记,先处理 301 和 robots.txt 这两类可立即修复的问题。