改版或迁移时,不能只看新站是否上线、旧 URL 是否跳转,而要核对“旧域名积累的收录信号有没有被正确继承”。核心检查项是:旧 URL 到新 URL 的映射是否一一对应、跳转是否为永久重定向、新页面是否允许抓取和索引、站点地图与内链是否指向新地址、旧域名是否仍能正常访问并完成跳转。任何一项缺失,都可能让原本收录好的域名在迁移后丢失已有索引。
迁移中最常见的误判,是首页能打开、能跳转,就认为整站迁移完成。实际上,收录好的域名往往有大量内页、栏目页、分页和带参数的页面被索引。核对时要逐类比对:
可执行步骤:从旧域名的索引或访问日志中抽样导出 URL 列表,按“有对应新页”“无对应新页”“重复变体”三类整理,再逐条验证跳转目标。判断结果是:一一对应的页面最有利于收录继承;全部指向首页则属于高风险,需要重新补映射。
旧 URL 应使用 301 永久重定向指向最相关的新 URL。302 临时跳转、JavaScript 跳转、meta refresh 跳转都可能让搜索引擎保留旧地址或延迟处理。还要检查跳转链:旧 URL 跳到中间页,再跳到最终页,会浪费抓取并增加失败概率。
检查项:
适用条件是旧页面仍有搜索价值或外链价值。如果旧页面已无对应内容,直接返回 404 比全部跳首页更清晰。判断结果是:单次 301 到相关新页为正常;多级跳转、302 或跳首页需要修正。
收录好的域名迁移后,新站可能因为测试遗留而禁止抓取。要分别核对:
robots.txt 是否误屏蔽整站或关键目录;注意,robots.txt 的抓取限制不等于可靠的索引移除,被屏蔽的页面仍可能因外链被索引;<meta name="robots"> 是否带有 noindex;这里要区分“可能原因”和“已经定位的原因”:页面不收录可能是 noindex、canonical 错误、抓取被拒或内容质量不足,不能只凭一个现象断定唯一原因。核对时应逐项排除。
站点地图不保证收录,但它是发现新 URL 的辅助入口。迁移后应更新站点地图中的域名,并确保其中只列最终可索引的 200 状态页面。同时检查站内链接是否仍指向旧域名:如果内链大量指向旧地址,会持续把抓取引向跳转链。
旧域名本身也应保持可访问并完成跳转,而不是立即停止解析。若旧域名无法访问,搜索引擎和用户都无法获得跳转信号。对于 HTTPS,迁移时还要确认证书覆盖新旧域名,但 HTTPS 不保证安全无漏洞或排名,它只是迁移中需要正常工作的基础条件。
面对改版或迁移,可按以下顺序决策:
代价在于:映射越细,前期工作量越大;但若为了省事全部跳首页,后期恢复收录的成本更高。适用条件是站点已有一定收录基础;若新站尚未上线或旧站无收录价值,则不必强行保留全部旧 URL。
下一步:从旧域名导出被索引或有点击的 URL 清单,按上述四类检查项逐条标注状态,先修复“有对应新页却跳错”的 URL,再处理无对应内容的页面。