网站规模扩大后,最先不该继续手工做的是那些“每次都要重复、结果必须一致、出错后很难回溯”的工作,典型包括批量页面的标题与描述写入、内链增删、跳转与状态码核对、索引状态巡检、结构化数据校验,以及多角色交付时的变更记录。手工并非一律退出:样本小、判断依赖上下文、或一次性的策略设计,仍适合人工完成。判断标准不是页面数量本身,而是这项工作是否已经变成可规则化、可批量核对、且错误成本随规模放大的重复动作。
慢和危险不是一回事。比如给十个栏目页重写标题,人工逐条判断更稳,慢一点可以接受;但给数千个商品页补同一类缺失的 meta description,人工复制粘贴就会同时引入三类问题:遗漏、重复、以及把不该改的页面改掉。前者是效率问题,后者是质量问题。
可以用一个简单假设来判断:假设这批任务有 2000 个页面,规则是“仅对状态为已上架、且正文超过 300 字的页面补写描述”。如果人工执行,你需要先筛选、再逐条写、再抽查。只要筛选条件在过程中变化一次,前面写的部分就可能基于旧条件。此时更合理的动作是把筛选条件写成可复跑的规则,人工只负责确认规则和抽查结果。这个动作的结果会直接决定下一步:如果规则能稳定复现同一批页面,就把它交给批处理;如果每次筛选结果都在变,说明前置的数据定义还没统一,应先解决定义,而不是急着自动化。
内链调整在几十个页面时,人工还能记住“哪个页面链向哪里”。规模扩大后,同一个目标页可能被几十个来源页引用,删除或改向一个页面时,人工很难确认所有入口。此时适合退出手工的是“全站范围的链接与状态核对”,适合保留人工的是“这个链接对用户是否有意义”的判断。
类似地,跳转链、404、软 404、以及页面是否被索引,属于抓取和索引两个不同环节的现象。抓取量下降或某个目录索引数归零,不能单独证明某次处理正确,也可能是抓取预算重新分配、页面被合并、或站点结构变化导致的。因此巡检工作的重点不是“今天数字是多少”,而是“和上一版规则相比,哪些页面发生了非预期变化”。
可执行的动作是:先固定一份需要长期观察的 URL 清单及其预期状态,再用脚本或站点工具定期比对。若比对结果稳定,说明清单和规则可用,下一步可以把异常项直接分派给对应负责人;若比对结果每次差异都很大,说明清单本身不稳定,应先收敛范围,而不是扩大自动化。
当编辑、技术、运营对同一件事有不同理解时,分歧往往不是判断不同,而是各自看到的“事实”不同。例如运营认为某批页面已经优化完成,技术认为模板还没上线,编辑认为文案已经交付。手工用聊天记录和表格维护状态,规模一大就会出现多个版本。
这时不适合继续手工做的是“状态同步”。更合适的做法是把每个页面的关键字段固定下来:当前模板版本、文案是否已写入、是否已发布、最近一次核对时间。字段不必多,但必须唯一来源。这样当有人说“已经完成”时,可以核对到具体页面和具体版本,而不是争论印象。
需要保留人工的是优先级排序和例外处理。规则能告诉你哪些页面不符合预期,但不能替你决定先修哪个栏目、哪个活动页可以延后。把可核对的部分交给系统,把取舍留给人,是规模扩大后比较稳的分工。
这些工作的共同前提是:样本有限、判断依赖具体语境、且错误后果不适合用统一规则兜底。一旦它们变成高频重复动作,就应重新评估是否拆分出可规则化的部分。
按这个顺序做,你会先得到一份“哪些动作可以交给规则、哪些必须留给人”的清单。它的价值不在于一次砍掉多少手工量,而在于让每个角色对同一批页面看到同一份事实,后续的验收和交接才有共同依据。