先给结论:不要为了“看起来完整”而给每个旧地址硬凑一个目标。把旧地址按价值分成三类——仍有等价内容的、只剩历史外链或访问价值的、已无任何继续存在理由的——第一类做一对一映射,第二类做站点级承接,第三类才让它自然退出。判断依据不是旧地址多不多,而是它现在还能不能给访问者一个说得通的落点。
下面用一个明确假设的情境串起整个决策过程。假设你运营一个企业站,原先放在共享虚拟主机上,后来迁到新的虚拟主机环境。迁移时栏目结构被合并:旧站有/product/a/、/product/b/、/news/2021/、/about/,新站只保留了/products/和/about/。于是旧地址里,有的能找到近似对应,有的完全找不到对应。这正是“没有完全等价目标”的典型处境。
处理方式的分岔点不是技术难度,而是旧地址还剩下什么。可以用三个可观察的证据来分类,而不是凭感觉。
这里有一个容易被忽略的反常现象:把大量不相关的旧地址全部重定向到首页,短期看访问者“没有撞到 404”,但会让搜索引擎和用户都难以判断这些地址真正对应什么。重定向到首页是一种兜底,不是等价替代。
一对一重定向成立的条件是:新旧页面主题一致,且旧地址仍有稳定进入量。动作是把旧路径永久指向新路径,然后观察该新页面的进入情况是否延续。如果进入量在切换后明显下滑,说明映射选错了目标,需要换一个更贴近的页面,而不是再加一条重定向。
站点级承接(指向栏目或首页)成立的条件是:旧地址没有单独对应的内容,但它属于某个仍然存在的主题范围。动作是把它指向该主题的栏目页。结果判断标准是访问者在该栏目页能否继续找到相关信息;如果栏目页本身内容很薄,这个承接就是空转,应当改为让它退出。
让旧地址自然退出成立的条件是:内容已无价值,且没有外部引用或收藏痕迹。动作是返回“未找到”状态,同时确保站内导航和站点地图里不再出现这些地址。需要说明的是,站点地图不保证收录,它只是告知;把已退出地址留在站点地图里,反而会让处理状态变得含糊。
回到前面的例子,逐条判断:
/product/a/在新站有/products/a/,主题一致——做一对一重定向。/product/b/的产品已停产,新站没有对应页,但旧地址曾被外部引用——指向/products/栏目页,而不是首页。/news/2021/是过期资讯,没有继续保留的理由——让它返回未找到,并从站内链接中移除。/about/路径未变——无需处理。这个假设例子的关键不是四条规则本身,而是每一步之后都要看结果再决定下一步:一对一重定向后要看目标页进入量是否延续;栏目承接后要看访问者是否继续点击;退出后要看是否还有外部进入。如果退出后仍持续有访问,说明分类判断有误,应把它重新归入“只剩访问价值”那一类。
robots.txt 的抓取限制不等于可靠的索引移除。用 robots.txt 挡住旧地址,只是阻止抓取,已经存在的索引记录不会因此自动消失;把它当成移除手段,会让旧地址长期处于“抓不到也删不掉”的模糊状态。要移除索引,需要让地址返回明确的未找到状态,并等待其被重新处理。
HTTPS 不保证安全无漏洞,也不保证排名。迁移时把旧地址整体跳到 HTTPS 新域名,是协议和域名的切换,不能替代“旧地址该落到哪里”这个内容层面的决策。
不同搜索引擎对重定向和移除信号的支持情况须分别核查,不能假设一处生效就处处生效。如果旧地址同时存在于多个搜索引擎的结果里,处理动作要一致,但观察要分开看。
最后,请求量、抓取量或某项统计归零,不能单独证明处理正确。它也可能来自抓取预算变化、外部链接自然衰减或统计口径调整。要判断处理是否合理,应结合目标页进入情况、站内点击路径和外部引用是否仍在,而不是只看一个数字的涨跌。
把旧地址按“仍有等价内容、只剩访问价值、已无存在理由”分好类,再对每一类选择一对一映射、栏目承接或自然退出,并在动作后观察结果调整下一步,这就是旧地址没有完全等价目标时更稳妥的处理顺序。