当页面从几十个增长到几百上千个,手工逐页改标题、查收录、盯死链会迅速变成瓶颈,但真正不适合手工做的并不是所有重复劳动,而是那些依赖全站一致性、需要频繁重跑、或人工判断无法稳定复现的工作。判断标准不是“累不累”,而是同一动作在规模变化后是否还产生可验证的结果。
小站阶段,手工逐页检查标题、描述和内部链接往往能发现大部分问题,因为页面少、改动少、记忆得住。规模扩大后,同样的方法会出现一个反常结果:检查过的页面看起来没问题,但整体收录、点击或抓取分布仍然恶化。这不是执行不认真,而是手工方式的作用范围没有随页面数量同步扩大。
常见解释有两个。第一种是抽样偏差:手工检查通常从首页、栏目页或最近更新的页面开始,这些页面本来就被频繁访问,问题最少;真正出问题的往往是深层、旧、入口少的页面,它们不在手工清单里。第二种是状态漂移:页面在上线后会被模板、插件、编辑操作反复改动,手工检查只是某个时间点的快照,无法在每次变更后重新验证。
要判断属于哪一种,可以做一个假设性的对比。假设网站有 2000 个页面,其中 200 个有稳定内链入口,1800 个只靠列表翻页或搜索到达。如果手工抽查的 100 个页面全部来自那 200 个入口充足的页面,发现的问题很少,就不能说明全站健康。此时应把检查范围按“入口数量”分层,而不是按“是否最近更新”分层。
如果深层、旧页面集中出现标题重复、描述缺失或链接指向失效,更接近抽样偏差;如果同一批页面在两次检查之间反复出现同类问题,更接近状态漂移。两者的下一步动作不同:前者要改检查范围,后者要改变更流程。仅凭一次全站抓取量下降或收录数字波动,不能单独证明是哪种原因,因为模板改版、服务器响应变化、内容批量下线都可能产生类似现象。
标题模板、描述规则、canonical 指向、分页与筛选参数的处理,这些要求全站统一。手工只能验证个别页面,无法证明全站一致。适合改为规则化检查:用站点地图或内链清单生成待查 URL 集合,再用脚本或爬取工具批量比对。动作结果会直接影响下一步——如果批量比对显示模板层一致,问题就落在内容层;如果模板层就不一致,先修模板比逐页改文案更有效。
少量死链可以手工替换。规模扩大后,同一批链接可能因为栏目调整、内容合并、URL 规则变化而反复失效。手工修完一轮,下一轮改版又会产生新的一批。更适合建立定期重跑机制:记录已知失效模式,在每次结构调整后重新检查,而不是等用户或日志暴露问题。
抓取、索引、排名是不同环节。手工在搜索框里逐页查询只能看到个别结果,无法区分“未被抓取”“被抓取但未索引”“已索引但排名变化”。当页面数量上升,应把索引检查改为按目录、按模板、按发布时间分组观察,而不是逐页确认。分组后如果某一类页面整体异常,才值得回到具体页面排查。
并非所有工作都该交给批量处理。内容质量判断、页面意图匹配、重要落地页的文案取舍、以及涉及品牌表述和合规的修改,仍然需要人工决定。手工在这里的价值不是覆盖数量,而是处理无法用统一规则表达的例外。把手工时间从全站一致性检查中释放出来,投入到这些例外上,才是规模扩大后的合理取舍。
一个可操作的划分方式是:凡是能用“同一规则适用于所有同类页面”描述的工作,优先规则化;凡是需要“看具体页面语境才能决定”的工作,保留人工。按这个划分重新分配时间后,如果批量检查发现的问题数量先上升再下降,说明之前的“健康”只是抽样造成的假象;如果问题数量始终很低但整体表现没有改善,则应把注意力转向内容与需求匹配,而不是继续增加检查频率。