当页面数量从几十页增长到几千页,真正先失控的通常不是策略,而是那些“顺手做一下”的手工环节。判断标准可以归结为一条:如果一项工作依赖逐页查看、逐条复制、凭记忆保持一致,那么它在规模扩大后就不再适合手工承担。更实际的分界是——模板层能覆盖的改动继续手工做会制造不一致,而需要判断意图、取舍和例外的工作即使规模变大也不该交给批量脚本。
规模扩大后最先出问题的是重复性手工操作。典型包括:批量修改标题标签的格式、统一内链锚文本、给新页面补 canonical、修正分页链接、清理参数 URL 的抓取入口。这些工作的共同点是规则明确、结果可预期、页面之间高度相似。手工逐页处理时,前二十页还能保持一致,到第五百页就会出现拼写差异、漏改、重复值,而且没人能说清哪些页面已经处理过。
另一类工作则相反:判断某个栏目是否应该合并、决定一篇旧内容该更新还是该下线、评估某个页面是否值得继续投入。这类工作即使站点有上万页,也不适合交给批量规则,因为每个决定都依赖对搜索意图和业务价值的理解。把它们脚本化,得到的是一致但错误的答案。
区分依据不是工作量大小,而是判断是否可以写成稳定规则。能写成规则的,规模一大就该离开手工;不能写成规则的,规模再大也要保留人工判断。
当一项工作满足“规则固定、页面同构、结果可验证”三个条件时,继续手工做只会放大错误。此时合理的动作是把它下沉到模板层或站点级配置:标题与描述由字段拼接生成,canonical 由路由规则统一输出,分页与筛选参数在模板里决定是否可抓取。
实施时先做一个小范围验证:选一个结构最典型的栏目,把规则应用上去,然后检查三类页面——列表页、详情页、分页或筛选页——是否都符合预期。这一步的结果直接决定下一步:如果模板输出在三种页面上都一致,就可以推广到同类栏目;如果某类页面出现异常,说明规则还没覆盖它的结构,此时应该先补规则,而不是回头继续手工修。
这种选择的代价是前期设计成本,而且规则一旦上线,修改的影响面也更大。它适合页面高度同构、字段来源稳定的站点。反过来,如果站点栏目结构差异极大、每个栏目都有自己的字段逻辑,强行统一模板反而会制造大量例外,这时手工加局部规则可能更划算。
内容取舍、栏目合并、旧页面存废这类工作没有稳定规则可写。规模扩大后,它们不适合手工逐页处理,但也不适合完全自动化。可行的做法是缩小人工介入的范围:用可导出的清单把候选页面按“有流量但无转化”“有转化但无流量”“长期无展现”分组,人工只处理每组里优先级最高的那部分。
这里要避免一个常见误判:把展现量或抓取量的下降直接当成页面该处理的证据。展现下降也可能来自查询需求本身变化、竞争对手改版、页面被合并,甚至只是统计口径调整。抓取量归零同样有多种解释,不能单独证明某个页面已经失效。正确顺序是先确认现象的原因,再决定这个页面进入哪一组,而不是看到数字下降就批量删改。
这种选择的代价是处理速度受人工判断限制,站点越大,能覆盖的比例越低。它适合页面价值差异大、业务规则难以量化的站点。如果强行用脚本替代判断,短期看处理量上去了,长期会损失那些本可以保留的页面。
面对一项正在手工做的 SEO 工作,可以按以下顺序决定去留:
举例说明这个顺序如何影响决策(以下为假设情形,非真实项目数据):假设某站有三千个详情页,标题目前由编辑逐页填写。如果标题格式可以归纳为“产品名 + 类别 + 品牌”且字段在数据库里都存在,那么它属于可规则化的工作,应下沉到模板;如果部分页面的标题需要体现促销状态或地域差异,那么这些页面应被排除在统一规则之外,单独维护。这个例子的重点不是数字,而是“字段是否齐备、例外是否可控”决定了选择哪条路径。
有三类工作不适合交给批量处理。第一类是涉及页面存废的判断,误删的恢复成本高于保留成本。第二类是内链锚文本的语义选择,机械替换会制造大量不自然的锚文本。第三类是跨栏目合并与重定向设计,它需要理解每个 URL 的历史角色,脚本只能按字符串相似度猜测。
反过来说,模板层能覆盖的一致性工作、可导出清单的分组筛选、规则明确的字段拼接,这些在规模扩大后继续手工做只会积累不一致。把这两类工作分开,比笼统地问“要不要自动化”更有用。规模扩大带来的真正变化,是手工操作从“慢但可控”变成“快但不可控”,而判断的依据始终是规则是否稳定,而不是工作量是否够大。