网站恢复过程中,一旦页面从几十个增长到几百上千个,手工逐条检查标题、内链和重定向就会成为瓶颈。判断标准不是“手工能不能做”,而是这项工作是否需要在每次内容变动后重复执行、是否需要跨页面比对。如果答案是肯定的,就该转向模板化或脚本化处理;如果只是一次性修正少量核心页面,手工反而更可控。
网站恢复通常同时包含两类任务。一类是修复历史遗留问题,比如早期改版留下的死链、丢失的栏目页、错配的 canonical。另一类是维持状态,比如新发内容是否自动进入正确的内链结构、分页是否正确输出、旧链接是否持续跳转到新地址。前者数量有限,做完就结束;后者随内容增长不断产生新条目。
当站点规模较小时,这两类工作混在一起手工处理问题不大。但页面数量上升后,持续同步类工作会反复占用时间,而且每次人工操作都可能引入新的不一致。判断依据可以看一个简单信号:同一项检查在最近三次内容更新后都需要重新做一遍,说明它已经不适合纯手工。
几十个页面时,人工扫一遍标题是否重复是可行的。到了几百个页面,人工比对容易漏掉跨栏目、跨分页的重复。更实际的做法是先导出全部标题,用脚本或表格公式找出完全重复和高度相似的组合,再人工判断哪些需要改写。动作上,可以先对重复组做标记,只把真正冲突的页面列入改写清单,而不是全站重写。
例外情况是:如果重复只出现在少量归档页或标签页,且这些页面本身不参与主要获取路径,可以先不动,优先处理栏目页和内容页的冲突。
手工加内链在恢复初期有助于把权重集中到核心页面。但如果每发一篇新文章都要手动回填十几条旧文链接,规模一大就会拖延发布节奏。此时更适合用模板或规则生成基础内链,比如按分类自动关联同栏目内容,再对少数重点页面手工补充上下文链接。
这里的分界条件是:内链是否需要理解上下文语义。自动关联适合“同主题推荐”,手工适合“正文中自然提到的概念指向另一篇解释”。前者可以批量化,后者仍值得人工处理。
改版或栏目调整后,如果每次新增旧链接都靠人工加一条跳转,数量一多就容易出现链条跳转和循环。更稳妥的方式是按路径规则批量映射,例如把整个旧目录映射到新目录,再对个别特殊页面单独处理。动作上,可以先整理出旧路径的规律,用规则覆盖大部分情况,然后只核对规则未命中的少数地址。
需要注意的是,规则映射的前提是旧路径结构本身有规律。如果旧站路径混乱、没有统一前缀,强行套规则反而会制造错误跳转,这时仍应保留逐条确认。
手工处理并没有被完全否定。以下条件同时成立时,继续手工是合理选择:页面总量在可人工覆盖的范围内;恢复目标集中在少数核心页面;内容更新频率低,不需要每次发布后重复检查;并且操作者能直接看到页面效果,不需要跨系统比对。
反过来,如果站点已经进入稳定更新阶段,且恢复目标涉及全站结构,那么把重复性工作交给规则或脚本,把判断性工作留给人,通常更可持续。这个取舍的关键不是工具本身,而是这项工作会不会随着规模扩大而线性增加人工投入。
假设一个站点有 300 个页面,其中 40 个是主要栏目和内容页,其余是标签与归档。恢复初期,人工逐页检查这 40 个页面的标题和内链是可行的。但当内容页增加到 200 个,且每周新增 5 篇时,继续逐页检查会挤占内容生产时间。
此时可以先做一步:把新增页面按模板统一输出标题结构和基础内链,再每周抽查一批页面,确认模板没有产生新的重复。这样做的结果是,人工从“每次全查”变成“定期抽查”,释放出的时间可以用于处理真正需要判断的页面,比如转化路径上的关键页。
如果抽查发现模板产生的标题重复率明显上升,说明规则需要调整,而不是回到全量手工。下一步应修改模板中的变量规则,再重新抽查,而不是逐页修补。
建议先列出一份重复性工作清单,标注每项工作的触发频率:是改版时做一次,还是每次发布后都要做。触发频率高的项目优先考虑规则化;触发频率低但判断复杂的项目保留手工。完成这一步后,再决定哪些页面进入批量处理、哪些保留人工核对,后续的恢复节奏会清晰很多。