改版或迁移时,网站收录查询工具给出的数字只是线索,不能当作结论。真正要核对的是:新页面是否可被抓取、可被索引、返回正确状态,以及旧地址是否把信号传递到了新地址。下面这份清单按“查什么、怎么查、结果说明什么”组织,逐项留下证据,才能判断收录波动是迁移引起,还是本来就没被收录。
要查什么:新站或新目录是否被 robots.txt 误屏蔽,页面是否带有 noindex。
怎么查:在浏览器直接打开 /robots.txt,逐条看 Disallow 路径是否覆盖了新 URL;对目标页查看 HTML 源码中的 <meta name="robots">,以及响应头里的 X-Robots-Tag。改版后常见的情况是测试环境遗留的屏蔽规则被带上线。
结果说明什么:如果 robots.txt 禁止抓取,搜索引擎无法获取页面内容;如果页面带 noindex,即使能被抓取也不会进入索引。注意,robots.txt 的抓取限制不等于可靠的索引移除——已收录的旧 URL 仍可能留在结果里,需要配合其他方式处理。这两类问题必须分开判断。
要查什么:旧 URL 返回的是 301、302、404 还是 200;重定向是否出现多跳或闭环。
怎么查:用命令行工具或浏览器开发者工具的 Network 面板,对一批代表性旧 URL 逐个查看状态码和 Location 头。重点覆盖:首页、栏目页、文章页、带参数页、曾经有过外链的页面。
结果说明什么:301 表示永久迁移,是改版换域名的常规选择;302 是临时跳转,长期使用会让搜索引擎保留对旧地址的判断;404 意味着旧地址的信号无法传递;重定向链超过两跳会拖慢抓取并可能中断传递。若发现旧地址直接返回 200 但内容是无关页面,这属于软 404,同样需要修正。
要查什么:是否每个重要旧 URL 都有明确的新地址;站点地图是否只包含新 URL。
怎么查:导出旧站的核心 URL 列表(可从服务器日志、历史站点地图或站长平台数据中获取),逐条映射到新 URL,形成对照表。然后打开新站的站点地图,检查其中是否混入了已失效的旧地址。
结果说明什么:映射表是判断迁移是否完整的依据。缺少映射的页面,其历史积累会中断。站点地图提交后不保证收录,它只是告知发现路径,最终是否索引仍取决于页面质量和抓取预算。若站点地图里同时存在新旧两套 URL,会分散抓取,应只保留可访问的新地址。
要查什么:新旧 URL 在索引中的实际状态,以及收录数量随时间的变化趋势。
怎么查:选取固定的一组样本 URL,包括首页、高流量页、深层次页,分别用站点查询语法和收录查询工具检查。记录每次查询的日期和结果,而不是只看单次数字。
结果说明什么:如果旧 URL 仍被收录而新 URL 未出现,说明重定向或抓取环节可能有问题;如果两者都未收录,更可能是页面本身未被发现或质量不足。不同搜索引擎的索引情况要分别核查,不能用一个引擎的结果推断另一个。收录数字下降本身不必然是故障,改版期间短期波动属于常见现象,关键是看新 URL 是否在逐步被替换进来。
要查什么:新站是否全站可正常访问,HTTPS 证书是否有效,是否存在混合内容。
怎么查:用浏览器逐个打开样本页,查看控制台是否有证书错误或资源加载失败;检查页面内引用的图片、脚本、样式是否仍指向 HTTP 地址。
结果说明什么:证书无效或大量混合内容会阻碍正常抓取和用户体验。需要明确的是,HTTPS 不保证安全无漏洞,也不保证排名,它只是基础条件之一。若迁移后大量内链仍指向旧域名,会形成额外的跳转负担,应统一替换。
下一步建议:先完成前三项,把发现的问题按“阻断抓取”“阻断索引”“信号未传递”分类记录。只有先确认问题属于哪一类,后续的修正动作才不会互相干扰。