核心判断不是“旧地址还能不能打开”,而是旧地址承载的意图在新站有没有可承接的落点。若存在意图接近的页面,优先做一对一的永久重定向;若只有栏目级或搜索页能承接,宁可让旧地址返回410或404,也不要把它跳到不相关页面。下面用一个假设情境把决策过程走完。
假设某企业站把产品站迁移到新域名,旧站有一批“型号+参数”的详情页。新站把同系列产品合并成一个总览页,旧详情页不再有单独页面。此时要拆开看:缺的是内容本身,还是只是缺一个独立URL。
判断依据可以落到一个动作上:打开旧URL,记录它原本回答的问题,再去新站找“回答同一个问题的页面”。找不到就说明等价目标不存在,这一步的结论会直接决定后面选重定向还是选失效。
近似目标成立的前提是用户意图基本一致,而不是“都跟这个产品有关”。总览页能承接的前提是它真的覆盖了旧页的核心信息;如果只是同一大类,跳过去会制造新的体验落差。
可操作的做法是给每个旧地址标一个承接等级。假设把旧详情页分成三档:
第三档容易被忽略:把大量旧页跳到分类页,等于把不同意图压到同一个落点,用户仍要再找一次。这种情况下失效比错误重定向更诚实,也更容易在后续查询中看出真实缺口。
两者都表示目标不存在,区别在于语义强度。410表示“曾经存在且已永久移除”,404表示“未找到”。如果旧页面确实被永久删除且不打算恢复,410表达更明确;如果不确定以后是否重建,404更稳妥。
这里要避免一个常见误判:robots.txt限制抓取不等于索引移除。即使把旧路径写进robots.txt,已收录的URL仍可能出现在结果里,因为限制抓取和从索引中移除是两件事。要让旧地址真正退出,需要让服务器对旧URL返回410或404,而不是靠robots.txt挡。
另一个误判是把站点地图当收录保证。把新地址放进站点地图只是提示,不保证被收录;旧地址从站点地图移除也不等于它立即从索引消失。这两件事都不能替代对旧URL本身状态码的处理。
做完上面选择后,需要一轮可复查的验证。假设迁移后一周,对旧域名下的一批URL发起查询,会看到几种结果:
如果查询结果显示大量旧URL仍是200,下一步不是继续加跳转规则,而是确认旧站是否还有内容在对外提供。若旧URL已返回410但索引中仍有记录,合理动作是保持现状并继续观察,而不是因为“还没消失”就改成跳转到首页——后者会用错误落点掩盖真实状态。
同一批旧地址,在“新站已有对应内容”和“新站主动放弃该内容”两种前提下,处理方式相反。前者做一对一永久重定向;后者让地址失效并接受短期流量下降。把两者混在一起,最容易出现的错误是:为了保住旧URL的访问量,把所有旧地址统一跳到首页。这个动作会让查询结果看起来“没有死链”,但用户和爬虫都被送到同一处,既解决不了意图匹配,也看不出真正缺了哪些内容。
因此决策顺序应是:先确认旧页回答的问题,再找新站是否有回答同一问题的页面,有则一对一重定向,没有则让旧地址返回明确的失效状态,最后用查询结果核对,而不是用“是否还有访问量”作为唯一标准。