当旧站迁移到新站、旧地址无法逐条对应到新页面时,先做一次可回退的映射判定:能确认内容等价的保留原路径并直接重定向;只能确认主题相近的,改写为指向新栏目或新页并保留一层过渡说明;无法确认或已无对应内容的,让旧地址返回明确的失效状态,而不是统一跳首页。这个判断不依赖完整的访问日志或后台权限,用站点地图、旧导航和页面标题就能起步。
保留的前提是“同一件事还在”。旧地址如果指向的是产品详情、服务说明、政策条款这类长期存在的内容,且新站有内容等价的页面,就应当把旧路径原样保留,或做一对一的永久跳转。判断依据可以来自三处:旧站导航里被反复链接的层级、旧页面标题与正文首段描述的对象、外部仍可访问的引用来源。三者指向同一个对象时,映射基本成立。
如果旧站已经无法访问,只剩一份导出的地址清单,那么单看 URL 字符串不足以判定等价。像 /news/2019/03/15/1234 这类结构里只有时间和流水号,没有主题信息,就不能凭编号相近去猜新页。此时更稳妥的做法是先处理那些能从地址词根看出栏目归属的条目,其余留待补充证据。
改写适用于“大类还在、具体对象变了”的情况。比如旧站有一批按年份归档的活动页,新站取消了年份归档,只保留活动栏目。这时把每个旧地址都跳到栏目首页,会让访问者反复落到同一处、无法判断自己找的内容是否还在;更合适的做法是跳到新栏目下最接近的那个页面,并在该页顶部用一句话说明内容已合并或调整。
改写的边界要写清楚:一个旧地址只对应一个新地址,不做多对一的批量归并,除非这些旧地址本来就指向同一份内容。改动后要记录三列信息——旧地址、新地址、判定依据。这份记录的作用不是留档,而是让下一步的验证有对照物:当某个新地址后续再次调整时,能知道有多少旧地址依赖它。
并非所有旧地址都需要救。当旧页面描述的产品已下架、活动已结束、政策已被替代,且新站没有任何内容承接同一需求时,把它跳到一个无关的新页,比直接失效更糟:访问者会以为自己找错了,而后续的排查也会被这条假映射干扰。
失效状态要给出可理解的反馈,而不是空白页或自动跳首页。可以在失效页上说明该内容已不再提供,并给出当前仍然有效的相关入口。这里有一个容易误判的现象:如果某段时间内旧地址的请求量或抓取量降到零,并不能单独证明“这个地址可以安全删除”。请求归零还可能来自服务器屏蔽、链接自然衰减、统计口径变化或采集范围调整。要区分这些解释,需要看同一时期其他同类地址是否也同步归零;只有孤立归零,才更可能说明该地址确实已无人使用。
没有服务器配置权限、拿不到完整访问日志时,仍然可以完成一轮基础映射。可执行的最小动作是:从旧站导出可访问的页面清单,按栏目分组,对每组只处理层级最高、被链接最多的前若干条地址,逐条做保留、改写或退出的判定,并把结果整理成映射表交给有权限的一方去实施。
这样做的影响是可预期的:覆盖范围有限,但每条判定都有依据,后续补充数据时可以按同一套标准继续扩展,而不是推翻重来。需要说明的是,完成映射并不能推出访问量会回升或新页会被正常收录,它只解决“访问者到达旧地址后能否找到对应内容”这一件事。至于收录与排序的变化,还取决于新页本身的内容质量、站内链接结构和抓取情况,不能由映射动作单独决定。
假设旧站有 40 条产品地址,新站重构后只保留 25 个产品页。若其中 20 条能一一对应,就做一对一保留;剩下 5 条属于同系列但型号合并,就改写到合并后的产品页并加一句说明;其余 15 条对应的产品已停产且无替代,就让它们进入失效页并列出在售系列入口。这个分法的关键在于:判断依据来自产品是否仍存在,而不是来自地址字符串是否相似。按这个假设,最终需要人工核对的只是那 5 条合并项,工作量从 40 条降到 5 条,而剩下的 35 条都有明确归属,不需要反复确认。