当站点从几十个页面扩到几百上千个页面后,最先撑不住的往往不是策略,而是手工执行。判断标准可以简化成一条:一项工作如果每次都要人逐条打开页面、逐条复制粘贴、逐条核对,且结果需要和上一次保持一致,它就不适合继续手工做。反之,一次性判断、需要经验取舍、涉及本地业务语境的决策,手工反而更稳。下面按两种规模条件分别说明该换成什么动作,以及换完之后下一步会受什么影响。
规模化后出问题的通常不是内容质量,而是重复动作带来的不一致。可以按三个信号区分:
三项都命中,说明这项工作已经进入"该交给脚本或模板系统"的区间。只命中数量、不命中一致性,例如给每个栏目写导语,仍需要人工判断,因为写错不会立刻暴露,而写对也没有唯一答案。
站点在几百页以内时,手工处理加抽样检查是合理的。这个阶段页面之间的差异大,规则还没稳定,过早写脚本反而要反复改脚本。此时可以保留手工的动作包括:
但这个阶段就要开始做一件为规模化铺路的事:把已经确认过的规则写成清单,例如"栏目页标题格式""产品页描述是否带地区词"。动作结果是,当页面数翻倍时,你能直接判断哪些规则可以固化,而不是重新讨论一遍。
页面数进入千级区间后,以下工作继续手工做,出错概率和执行成本会同时上升:
需要说明的是,抓取、索引、排名是不同环节。批量提交站点地图只影响被发现和抓取这一环,不能直接推断排名会变化。巡检报告里"抓取量下降"也可能是服务器波动、内容更新减少或站点结构调整导致,不能单独作为处理正确的证据。
假设一个站点有 1200 个产品页,原先由编辑逐页修改标题。假设每次改 200 页、每页耗时 2 分钟,一轮就是约 400 分钟,且第二个月再改时格式已经和第一轮不完全一致。换成"统一模板加变量、只人工处理前 50 个高价值页面"后,剩余页面由规则生成。动作结果是:编辑的时间从重复修改转移到检查异常样本上,下一步可以据此判断模板是否需要按栏目拆分,而不是继续加人手。
这个例子的数字只用于说明比较方法,不代表任何实际项目的耗时或效果。它要说明的是:当一致性要求高于单页判断时,模板化加抽查比纯手工更可控。
批量处理解决的是重复和一致性问题,但它会放大错误。规则写错一次,可能影响全站。因此以下工作不适合交给自动化:
合理的分工是:机器负责"每次都一样"的部分,人负责"每次都要想"的部分。做完这一步切换后,下一步应建立一份异常清单,记录哪些页面被规则排除、原因是什么,避免下次批量执行时把有用页面一起改掉。
回到最初的问题:网站规模扩大后,不适合继续手工做的是那些重复、要求一致、结果可程序验证的工作;而需要语境、取舍和业务确认的工作,仍然应该留在人工环节。把这条线划清楚,规模扩大才不会变成执行负担的等比例放大。