没有完全等价目标时,优先判断旧地址是否仍有独立搜索需求或外链价值:有,就保留并改写为最接近的可用页面;没有,就让它返回410或404退出索引。301只适用于新旧内容确实对应的情况,硬凑一个“差不多”的目标会把无关流量和权重一起带偏。
保留、改写、退出不是按喜好排序,而是按旧地址与现有资源的对应关系决定。
规模化时最容易出错的,是把个别样本的经验直接套到全站。一个旧地址301到近似页后表现平稳,不能推出所有近似页都该这样处理;样本成立往往依赖该页本身的外链质量、目标页的承接能力,以及两者意图重合度,这些条件在批量迁移中未必同时具备。
迁移中最常见的误判,是拿新旧标题做字符串比对,相似就301。更可靠的做法是逐条核对旧地址当初满足的查询意图,再看目标页是否满足同一意图。
可以用一组可区分的证据来判断:
假设一个旧地址原本是某型号的选型说明,站内只剩该型号的购买页。两者都涉及同一型号,但意图不同:前者是决策参考,后者是下单。此时301会把寻找选型信息的访问者直接推到购买页,短期看流量没丢,长期看目标页的意图信号被稀释。更稳妥的选择是保留旧地址并改写为精简的选型说明,或在购买页中补足选型信息后再做301,具体取决于该旧地址是否还有外链和搜索需求。
保留URL不是把旧内容原样挂着。迁移后如果旧地址内容与现行产品、价格、规格已经矛盾,保留反而制造错误信息。改写的前提是:该地址仍有外部链接、仍有搜索需求,且站内没有更合适的承接页。
实际操作上,可以先导出旧地址清单,标注每个地址的外链数量级、站内入口数和最近一次有效访问趋势,再决定保留哪些。保留的地址要更新内容、修正失效链接、补上指向当前相关页面的内部链接。做完这一步后,观察该地址在后续抓取和索引中的状态变化,再决定是否需要对其中一部分追加301。这个动作的结果会直接影响下一步:如果保留后旧地址逐步恢复稳定访问,就不必再迁;如果长期没有访问且外链价值低,可以转为退出。
对确认无承接价值的旧地址,返回410或404是合理选择。需要避免两种做法:一是用robots.txt禁止抓取,二是把旧地址全部301到首页。
robots.txt限制抓取,不等于可靠的索引移除。被禁止抓取的URL仍可能因为外链而留在索引里,只是摘要信息逐渐过期;已经收录的页面也不会因为加了禁止规则就立刻消失。要真正退出,应让地址返回明确的410或404状态,并确保站内不再链接这些地址。
把旧地址统一301到首页同样有代价:大量无关地址指向首页,会让首页承接的意图变得杂乱,也让原本可能仍有价值的旧地址失去独立入口。只有在旧地址确实没有独立意图、且首页能合理承接时,才考虑这种处理。
迁移完成后,总量指标平稳不代表每个地址都处理正确。请求量、抓取量或某类状态码归零,都不能单独证明处理得当——它也可能是抓取预算转移、站点地图未更新、服务器响应变慢等合理解释。
更有效的复查方式是抽两类样本对比:一类是301后表现稳定的地址,一类是301后长期没有访问的地址。对后者逐个核对目标页是否真的承接了旧意图,若发现目标页与旧地址意图不符,应改回保留或退出。站点地图要及时反映保留和退出的结果,但站点地图本身不保证收录,它只是帮助发现地址状态的一种途径。不同搜索引擎对410、404和301的处理节奏存在差异,需要分别核查,不能用一个引擎的表现推断全部。
最终的选择标准可以简化为一句话:旧地址还有独立意图就保留改写,有同意图目标才301,两者都不成立就让其明确退出,并且用抽样复查来发现批量处理中被掩盖的例外。