规模扩大后最不该继续手工做的,是那些“每新增一批页面就要重复判断一次、且判断规则已经稳定”的链接属性处理,尤其是对站内链接、用户生成内容和历史遗留外链的 nofollow 逐条添加。手工适合规则尚未成形、样本量小、需要人工权衡的阶段;一旦页面数量、链接来源或审核频率超过一个人能稳定复核的范围,就该把这类工作转为规则驱动,把人力留给例外判断。
判断是否该退出人工,不看页面总数,而看三个条件是否同时成立:处理对象同质、判断标准可以用一两句话说清、出错后的影响可回滚。站内链接最常见的情况是:导航、分页、筛选参数、登录注册入口、购物车流程页。这些位置是否加 nofollow,一旦团队内部形成结论,就不会因为单篇文章内容不同而改变。
反过来,下面这些仍适合人工保留:
换句话说,规则稳定的部分交给模板或程序,规则不稳定的部分继续人工。两者不是替代关系,而是分工。
手工处理的问题不是“慢”,而是“不可复核”。当同一类链接分散在成百上千个模板或内容条目里,人工添加后很难回答两个问题:哪些已经处理过,哪些因为改版又变回可传递状态。此时真正的风险是遗漏和回退,而不是效率。
可以用一个假设例子说明取舍。假设一个站点有 200 个筛选参数组合,每次改版后需要检查这些参数链接是否仍带 nofollow。若靠人工逐页查看,一次检查可能覆盖不全;若把规则写进模板或统一输出逻辑,新增参数会自动继承处理。这里的动作是:先把筛选参数按“是否影响收录价值”分组,再决定哪些进模板、哪些留人工。分组结果直接决定下一步是改模板还是继续抽查。
需要说明的是,抓取量下降、某些链接不再出现在抓取统计里,都不能单独证明 nofollow 处理正确。抓取减少也可能来自内链减少、页面质量变化、服务器响应或抓取预算分配调整。判断处理是否有效,要结合日志、索引状态和实际链接关系一起看。
“退出人工”不等于“全部自动化”。更稳妥的做法是把人工工作改写成规则加抽检。具体可以按下面的顺序推进:
这个顺序的关键在于:先固化规则,再减少人工。若规则本身还没稳定,直接自动化只会把错误放大。
保留人工处理 nofollow 的合理前提是:样本量小、判断依赖上下文、错误代价高且难以批量修正。比如一篇深度报道中引用了合作方链接,是否加 nofollow 取决于合作关系和编辑独立性的判断,这类工作不适合完全交给模板。
退出的条件则相反:同类链接反复出现、判断结论一致、修改可以通过模板或字段批量完成。满足这些条件后,继续手工处理不仅浪费人力,还会让处理状态变得不可追踪。更实际的做法是,把人力从“逐条加属性”转移到“维护规则、处理例外和验证结果”上。这样做的直接结果是:新增页面自动继承处理方式,人工只需要关注规则未覆盖的部分,下一步的优化重点也从数量转向规则质量。