页面数从几十涨到几千以后,最典型的分歧是:有人觉得“手工做更放心”,有人觉得“必须交给程序”。两种说法都可能对,区别在于这项工作是否还依赖逐页判断。只要一项操作需要针对每个页面看内容、看意图、看链接关系,它就还适合手工;一旦它变成同一规则重复套用到成百上千个URL,手工就不再是谨慎,而是把时间花在复制粘贴上。
规模扩大后常见的情况是,团队人数没变,但每周能处理的页面反而变少。这时有两种解释。
区分这两种解释的证据很直接:抽查最近处理的二十个URL,记录每个URL实际花掉的时间和判断依据。如果大多数时间用在“判断这个页面该不该留、该指向谁”,属于解释一;如果大多数时间用在“把同样的标题规则、内链规则、canonical规则再填一遍”,属于解释二。前者要继续保留人工,后者应当拆出可批量执行的部分。
判断标准不是“先进还是落后”,而是这项工作有没有稳定的输入和输出。
标题、描述、canonical、hreflang这类字段,如果同一类页面遵循同一套生成逻辑,就适合用模板加数据源生成,再由人工抽查边界情况。实际动作是:先选一个页面类型,把字段来源写成规则,跑出一批结果后随机抽检。如果抽检发现错误集中在少数字段,说明规则可用,下一步是补校验;如果错误分散且每页不同,说明这类页面还没到批量阶段。
相关文章、面包屑、上下级导航这类链接,如果关系由分类或标签决定,手工添加只会造成遗漏和不一致。把它交给模板后,人工的工作转为检查链接是否指向真正相关的页面,而不是逐个复制URL。
哪些页面被抓取、哪些没被索引,是状态核对,不是内容判断。规模大以后,逐页在后台查看既慢又容易漏。更合理的做法是按页面类型抽样,记录异常集中在哪一类,再决定是改结构还是改内容。这里要注意:抓取量下降、索引量归零,不能单独证明某次改动正确,也可能是抓取预算重新分配、站点结构变动或统计口径变化,需要结合具体URL样本看。
不是所有重复劳动都该自动化,以下两类一旦交给程序,风险高于收益。
一个假设的例子:某站有五千个商品页,若把描述全部交给模板生成,可能短期内产出很快,但若模板里包含未经确认的参数或承诺,后续清理成本会高于当初手工写的成本。这个比较方法的关键是:把“生成速度”和“纠错成本”放在一起算,而不是只看产出数量。
当多个角色对“该不该手工”有不同理解时,不要停留在争论,把它转成一张可核对的清单。
这样做的结果不是一次性决定所有工作,而是让下一步有依据:哪些可以继续扩大规则覆盖,哪些必须维持人工节奏。规模扩大后真正要放弃的,是那些“看起来在认真做、实际只是重复劳动”的手工环节,而不是所有人工判断。