死链接改版或迁移时应核对什么 - 上线前必须逐项确认的检查清单

📍 WDQWDWQD987AAAAA:216.73.217.115
📱 Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; ClaudeBot/1.0; +claudebot@anthropic.com)
🔗 /9a9d9b0b4133.html
📄

死链接改版或迁移时应核对什么 - 上线前必须逐项确认的检查清单

改版或迁移时核对死链接,核心是确认三件事:旧网址是否还有效、旧网址到新网址的对应关系是否完整、以及上线后是否真的按预期跳转。最关键的一步是建立完整的旧网址清单并逐条映射,而不是等上线后再靠工具补救。因为一旦旧链接返回404,用户和搜索引擎爬虫都会直接撞上死胡同,之前积累的入口价值可能就此中断。

准备阶段:先把旧网址清单和跳转映射做出来

改版前最容易漏掉的,是那些没有写在导航里、却真实存在并被访问过的网址。核对时可以从这几类来源汇总:

把这份清单整理成两列:旧网址、新网址。没有对应新页面的,要明确决定是跳转到最相关的上级页面,还是返回410表示永久移除。不要把所有失效页面统一跳到首页,这种做法会被判断为软404,用户也会因为找不到内容而离开。

实施阶段:跳转规则要逐条核对,不能只靠通配

301跳转是处理死链接最常用的方式,但批量通配规则容易误伤。例如把 /old/* 全部跳到 /new/,可能让本该保留的页面也失去原地址。实施时建议:

  1. 先按目录或栏目分组,检查每组内页面的新地址是否结构一致。
  2. 对无法用规则覆盖的特殊页面,单独写精确跳转。
  3. 确认跳转链没有多级:A跳到B、B又跳到C,应直接让A跳到C。
  4. 检查跳转是否误用了302。临时跳转不会传递原地址的权重信号,长期使用会让旧链接的价值难以转移。

如果迁移涉及域名更换,还要确认新域名的robots.txt没有误封爬虫。robots.txt的抓取限制不等于可靠的索引移除,它只约束爬虫抓取,不保证旧页面从索引中消失,也不保证新页面被收录。

验证阶段:上线后要实际访问,不能只看规则文件

规则写对不等于生效。验证时要模拟真实请求,检查返回的状态码和最终落地页:

这一步的判断标准很简单:旧网址返回301、落地页可正常打开、内容相关,三项同时满足才算通过。任何一项不满足,都要回到映射表修正。

维护阶段:持续监控新产生的死链接

迁移完成后,死链接仍会不断出现,来源包括内容编辑删改、外部链接失效、参数变化等。建议定期做两件事:一是用抓取工具扫描站内链接,找出返回404的内部链接;二是查看服务器日志中404请求的集中路径,判断是遗漏的旧地址还是新产生的问题。发现后按同样流程补充跳转或修正链接。

下一步,先导出你当前项目的旧网址清单,对照新站点结构逐条填写映射关系,把无法对应的页面单独标记出来再决定跳转目标。

图1 图2

nginx