手工做SEO在几十个页面时往往够用,但当页面数量、栏目层级和更新频率同时上升,真正的问题不是“手工累不累”,而是“手工还能不能保持判断一致”。我的结论是:凡是需要跨页面比对、重复执行、或依赖同一规则批量判断的工作,规模化后就不适合继续手工做;而涉及主题取舍、内容质量判断和异常归因的工作,即使规模变大也值得保留人工。判断标准可以归结为一条:如果一项工作的输出取决于“你这次记得查了哪些页面”,它就会在规模扩大后失控。
规模扩大后,人工不是被整体淘汰,而是从“执行者”退到“规则制定者和例外处理者”。下面三类工作适合保留人工:
换句话说,保留人工的前提是这项工作每次的判断依据可能不同。如果每次判断依据完全相同,只是重复次数多,那它就该退出人工队列。
典型场景是关键词蚕食和标题重复。页面只有几十个时,你可以靠记忆判断两个页面是否在争同一个意图;页面到几百个以后,记忆不再可靠,手工比对的输出取决于你这次抽查了哪些页面。
假设一个站点有约三百个内容页,其中两个页面标题都包含同一个核心词。手工检查时你很可能只看了导航里能点到的页面,漏掉藏在分页或标签聚合里的重复。这里的关键不是“工具一定比人准”,而是手工比对的覆盖范围无法稳定复现。可执行的动作是:先导出全部页面的标题和主要目标词,按词分组,人工只看被分到同一组的页面,判断是否真的意图重复。这样做的结果是,人工精力集中在少数真正冲突的页面上,而不是平均撒在几百个页面上;下一步就能决定是合并、改写还是保留其中一个。
适用前提是站点已经有稳定的URL结构和可导出的页面清单。如果站点还在频繁改版、URL不断变动,先固定结构再谈批量比对,否则导出的清单很快就过期。
还有一类工作本身不难,但需要每次发布都做一遍,比如检查新页面是否有可索引状态、是否误设了阻止抓取的指令、内链是否指向了已删除的地址。单次检查几分钟,但发布频率一高,漏检几乎是必然的。
这类工作的取舍不是“要不要做”,而是“由谁按固定规则做”。把检查条件写成明确规则,让流程在发布环节自动执行,人工只在规则报出异常时介入。需要注意边界:自动检查只能覆盖可形式化的条件,比如状态码、指令、链接可达性;它不能判断页面内容是否值得被收录。把后者也交给自动规则,会得到一堆“技术上没问题、内容上没价值”的页面。
一个可区分的证据是:如果某类问题在多次发布中反复出现,且每次的修复方式相同,说明它适合规则化;如果每次出现的原因都不一样,说明它需要人工归因,规则化只会掩盖问题。
手工工作在规模扩大后最隐蔽的问题,不是速度慢,而是标准漂移。同一个问题,你今天按一个标准处理,下周按另一个标准处理,站点内部就出现了不一致的信号。
举例来说,假设你手工决定哪些旧页面需要更新。页面少的时候,你凭近期印象挑选;页面多了以后,你只能挑选最近恰好看到的页面。结果是更新分布取决于你的浏览路径,而不是页面的实际状态。这种分布无法用“最近更新了多少页”来衡量对错,因为更新数量本身不说明选得对不对。
要减少漂移,可以把“挑选依据”先写下来,再决定哪些依据可以转成筛选条件。例如按最后修改时间、按内链数量、按是否有目标词排名变化来筛选,人工只处理筛选结果。动作的结果是:你得到一份可复核的候选清单,而不是一份凭印象的清单;下一步可以对比不同筛选条件下的候选差异,再确定长期使用哪一组条件。
面对一项具体工作,可以按下面顺序决定保留、改写还是退出人工:
需要说明的是,抓取、索引和排名是不同环节,某一项统计归零并不单独证明你的处理正确。它也可能是抓取预算变化、页面结构调整或外部链接变动带来的结果。因此在把某项工作交给规则之后,仍要保留人工复核异常这一步,否则规则会把一个环节的现象误当成另一个环节的结论。规模扩大后的合理状态是:规则负责覆盖和一致性,人工负责定义规则和处理例外。