直接回答:当页面、栏目、模板和改动频率增长到人工无法逐条核对时,最不适合继续手工做的是需要跨全站保持一致、且会反复触发的工作,包括模板级元信息与链接规则、内链增删与死链处理、索引状态巡检、结构化数据同步以及改动后的回归验证。判断标准不是“手工能不能做完”,而是“同一件事是否会在多个页面重复发生,且一次遗漏会不会让后续判断失真”。
规模扩大后常见一种分歧:运营说最近内容更新很勤,技术说抓取和索引没有明显变化,编辑则觉得页面之间的链接越来越乱。三种说法可能都对,因为它们看的不是同一层事实。手工时代,一个人能记住哪些页面改过、哪些链接指向哪里;规模上来后,记忆被模板、分页、标签页和批量导入冲散,分歧就从“谁做得多”变成了“谁掌握的是同一份事实”。
把分歧转成可核对项目的第一步,是承认抓取、索引、排名是不同环节。手工操作往往同时碰这三层,导致出问题时无法判断是哪一层先变。整站优化的目标,是让用户更容易获取内容,也让搜索引擎更容易理解页面;当页面数量增长,这个目标越来越依赖规则,而不是依赖某个人当天的手感。
对“手工做不完”通常有两种解释。
两种解释对应不同动作。若是工作量问题,优先把高频、重复、可判定的检查交给脚本或规则;若是规则缺失问题,先补模板和字段约定,再谈自动化,否则只是把混乱执行得更快。
可以核对下面几组证据,而不是凭感觉判断。
一个假设例子:某站有五千个页面,编辑每次上新后手工检查二十个页面的标题和链接。若这二十个页面来自同一模板,检查结果只能说明该模板,不能说明全站;若来自不同模板,二十个样本又不足以覆盖全部类型。此时更合理的动作是先按模板归类,再对每类模板建立一次可复用的检查规则。这个动作的结果是:后续抽查从“逐个页面看”变成“先看模板差异,再看例外页面”,下一步就能判断该补规则还是该加人手。
适合规则化的,通常是判定标准明确、重复发生、且结果可验证的工作。
仍应保留人工的,是涉及意图判断、内容质量和优先级取舍的工作。例如,某个栏目是否值得继续做、某类页面是否应该合并、某段内容是否真正回答了用户问题。这些判断依赖上下文,规则只能提供证据,不能替人决定。
需要强调的是,抓取量、索引量或某项统计归零,不能单独证明处理正确。它也可能是抓取预算调整、页面合并、服务器响应变化或统计口径变化的结果。把这类现象当作唯一证据,容易把正常波动误判为问题,也容易把真正的问题掩盖过去。
当多个角色对同一事实理解不同时,可以先做一件事:把争议写成一条可核对的陈述,并注明假设。例如,“模板 A 下的页面标题重复,是因为模板没有按栏目区分”,这是一个假设;核对方式是抽取模板 A 下的页面,比较标题生成规则和实际输出。若结果支持假设,下一步是修改模板规则;若不支持,下一步是检查内容字段或编辑流程。
这个做法的关键不是一次解决所有问题,而是让每次动作都产生可被下一步使用的证据。规则化之后,人工从重复检查中释放出来,转向判断例外和优先级。整站优化的规模问题,最终不是“手工还是自动”的二选一,而是把可判定的部分固定下来,把需要判断的部分留给合适的人。