结论有前提:当页面数量、栏目层级或更新频率超过一个人能稳定核对的范围时,逐条手工检查、手工改标题、手工记录内链关系就不再可靠。判断标准不是“手工能不能做”,而是“同一个事实是否还能被不同角色独立核对”。如果网站只有几十个页面、每周更新一两次,手工仍然成立;一旦同一处改动会牵动多个栏目、多个语言版本或多位编辑,手工流程的失效点就会从效率问题变成一致性问题。
规模扩大后最先出问题的,往往不是写内容,而是围绕页面事实的核对工作。可以用下面这组信号判断:
这些工作的共同点是:它们都需要对“全站同一事实”保持一致。手工适合处理判断,不适合承担全量核对。
多个角色对同一事实有不同理解,常见于“这个页面到底有没有被收录”“这个栏目算不算重复内容”。与其争论,不如把分歧写成可核对项:谁在什么时间、用什么入口、看到什么结果。例如,运营说某批页面已提交,技术说日志里没有对应抓取。这时不要先下结论,而是先确认三件事:提交动作是否真的执行、抓取是否发生在提交之后、页面返回状态是否稳定。三者缺一,就不能用“提交了”证明“被处理了”。
一个可以注明假设的短例子:假设某企业站有 800 个产品页,编辑手工维护一份“重点页清单”,只覆盖其中 50 个。三个月后,清单外的页面出现大量相似标题。此时不能直接说“手工维护导致排名下降”,因为更合理的解释可能是模板改动、内容采集或栏目结构变化。正确动作是先抽样对比清单内与清单外的页面差异,再决定是扩大清单,还是改为规则化生成与校验。这个动作的结果会直接影响下一步:如果差异集中在模板层,优先改模板;如果差异分散在编辑层,才需要调整流程。
当判断标准已经明确、且需要重复执行时,就适合从手工转为规则化处理。典型包括:
需要保留手工判断的部分同样明确:内容是否真正回答用户问题、栏目划分是否符合业务意图、页面之间是否存在实质差异。这些没有统一规则,交给工具反而会制造虚假的一致性。
如果网站规模虽大,但页面由同一套模板生成、字段来源单一、更新频率极低,那么手工核对少量关键页面仍然可能足够。此时“规模大”并不自动等于“必须自动化”。反过来说,即使页面只有一两百个,只要由多个团队分别维护、字段口径不一致,手工流程同样会失效。所以真正决定取舍的是事实是否分散,而不是单纯的页面数量。
先选一个当前争议最大的事实,例如“某批页面是否已被正确处理”,把它写成一张可核对表:事实名称、负责人、核对入口、预期结果、实际结果、差异原因。用一周时间只记录不修改。一周后,如果同一事实在不同角色那里仍然对不上,就说明该事实需要规则化;如果对得上,说明手工仍可维持。这个动作的结果会告诉你下一步该改流程还是改工具,而不是先买工具再找问题。