当页面数量、栏目层级和更新频率同时上升,手工做内链、逐页检查元信息、靠人工记录改版影响会很快变成瓶颈。但“规模大”本身不是停用手工操作的充分理由:如果页面只有几百个、改动不频繁,手工反而更可控。真正需要切换的临界点,是同一类操作开始反复出错、无法在合理时间内复查,而不是单纯的数量增长。
规模扩大后常见的情况是,单次手工处理的质量仍然高于批量脚本,但整体结果变差。典型表现是:新发的几十篇内容里,内链方向正确,可旧页面里指向已下线页面的链接没人清理;标题模板统一,但分页、筛选参数页的标题重复没人发现。这不是执行者变懒,而是手工方式的可检查范围没有随站点一起扩大。
这里有两种解释。第一种是流程问题:任务仍然依赖个人记忆和临时清单,没有把“谁在什么条件下检查什么”固定下来,所以规模一上来就失控。第二种是工具错配:站点结构已经超出人工逐页核对的能力,但团队还在用适合小站的表格和浏览器插件。两种解释对应的处理方式完全不同,先分清再动手。
可以做一个假设性的判断:抽一天时间,把当天所有手工操作记录下来,标记每项操作是“执行”还是“复查”。如果错误几乎都出现在复查环节——比如改完标题没回看、加完内链没验证目标页是否存在——那更偏向流程问题;如果执行环节本身就开始大量出错,比如同一批页面要花数小时才能改完,那更偏向工具和规模错配。
另一个可区分的证据是错误类型。流程问题往往表现为“漏做”:该加的没加、该删的没删。工具错配则更多表现为“做错”:批量替换误伤了不该改的页面,或者脚本抓取到的字段与页面实际显示不一致。把最近一段时间的错误按这两类归因,比凭感觉判断更可靠。
以下三类操作,在站点规模扩大后继续纯手工做,投入产出会明显变差。判断依据不是“能不能手工做”,而是“手工做的复查成本是否已经超过执行成本”。
一个实际动作是:先选一个栏目做试点,把该栏目的内链检查从手工抽查改为固定规则运行,并保留一份修改前后的 URL 对照。运行一轮后,如果发现的问题数量明显多于手工阶段,说明此前的手工覆盖确实不足,下一步应扩展到相邻栏目;如果问题数量很少且集中在个别页面,说明该栏目仍可维持手工,把精力放在更新更频繁的栏目上。
规则化不等于全部自动化。以下情况手工判断仍有价值:涉及内容意图的取舍,比如两个页面是否应该合并、某段内链是否对读者真正有用;涉及品牌表述和合规措辞的修改;以及首次出现的异常,比如某个栏目流量突然下降,需要先人工确认是抓取、索引还是内容层面的变化,再决定是否写成规则。
关键区别在于:手工用于“判断一次”,规则用于“重复执行”。如果把判断本身也交给批量脚本,容易在意图层面出错;如果把重复执行一直留给人工,就会在规模上出错。
可以用两个条件决定是否停止手工:一是同一类操作每周需要重复执行的次数,二是每次执行后需要复查的页面比例。当复查比例接近或超过执行比例时,手工方式已经不具备规模优势。此时应先固化规则和记录方式,再逐步替换,而不是一次性推翻现有流程。抓取、索引和排名是不同环节,规模扩大带来的问题往往先出现在抓取和索引的覆盖上,排名变化只是后续结果,因此切换的优先级也应从覆盖类工作开始。
如果站点规模没有明显变化,或者更新频率很低,继续手工做这些工作并不会造成实质损失,不必为了“看起来更专业”而提前引入复杂流程。