当站点从几十个页面扩到几千个页面时,最先出问题的往往不是策略,而是那些仍然靠人手逐条完成的操作。判断一项工作是否该停止手工做,关键看三点:它是否随页面数量线性增加、它是否要求每次判断标准一致、它的结果是否可以被程序复核。三条同时成立,手工做就会从“细致”变成“不可控”。
规模扩大后常出现这样的场面:内容团队每天手工挑选页面、手工填写标题与摘要、手工记录哪些链接被提交、手工在表格里勾选完成状态。表面上看执行很扎实,但一到复盘,几个人对同一件事的说法完全不同。有人记得某批页面已经处理,有人坚持没动过;有人把流量下降归因于内容质量,有人归因于提交延迟。矛盾不在于谁不认真,而在于手工流程没有留下可核对的中间状态。
解释一:问题出在判断标准不统一。 同一类页面,不同角色对“是否需要调整”的阈值不同。比如一批旧页面,有人按发布时间判断该重写,有人按当前点击判断该保留。标准漂移时,继续增加人手只会放大分歧。
解释二:问题出在记录方式不可复核。 判断标准其实一致,但执行痕迹散落在聊天记录、个人表格和临时文档里,无法还原某次处理到底覆盖了哪些页面、依据是什么。这种情况下,重新统一标准并不能解决核对困难。
取同一批页面,让两个角色各自独立判断“是否需要处理”,然后对比结果。如果分歧集中在同一类页面上,说明是标准问题;如果分歧分散、且两人都说不出具体依据,说明是记录问题。另一个证据是抽查:从已完成清单里随机抽十条,看能否在不问执行人的情况下复原判断依据。复原不了,记录方式的嫌疑更大。
需要保留手工的部分通常是:判断某类页面是否值得继续投入、处理脚本无法覆盖的例外情况、以及涉及内容意图的最终取舍。这些工作依赖上下文,数量不会随页面规模同步膨胀。
假设某站点有三千个页面,团队决定先统一判断标准,花两周重写规则文档,结果分歧依旧。换一种做法:先不改标准,只要求每次处理页面时记录页面标识、处理类型、依据规则和执行时间,运行一个月后再看分歧点。如果分歧集中在少数规则上,就只修这几条规则;如果分歧分散且无法追溯,说明记录本身仍不到位,需要继续细化字段。这个顺序的价值在于,先用低成本动作拿到可核对的证据,再决定是否投入更大改动。
把登记动作从手工改为自动产出日志后,下一步不是立刻扩大自动化范围,而是先核对日志能否回答三个问题:哪些页面被处理过、依据是什么、谁在什么时候处理的。三个问题都能回答,才说明记录方式已经可靠,可以在此基础上讨论标准统一。若只能回答第一个,说明日志字段还不够,继续补记录比继续加人手更有效。
抓取、索引和排名是不同环节,日志能证明的只是执行动作发生过,不能单独证明页面会被收录或获得更好位置。把执行记录当成结果证据,是规模扩大后另一个常见误判。