答案不是“全部自动化”,而是先分清哪些手工动作的代价会随规模线性放大。当页面从几十涨到几百上千,手工维护内链、逐个检查收录、按页改标题这三类工作最先失控;而判断封锁类型、决定内容取舍、处理敏感页面仍需人工。取舍标准是:每次操作是否需要在不同页面间做全局比较。需要比较的,就该换成规则或脚本;只需看单页的,可以继续手工。
判断一项工作是否该退出纯手工,看两个条件:一是操作次数是否随页面数增长,二是每次操作是否依赖其他页面的状态。同时满足这两条,手工做就会越做越慢,还容易漏。
反过来,判断某页是否属于被封锁影响的范围、某篇内容是否值得保留、某类页面是否触及合规边界,这些需要结合具体语境,手工做反而更稳。
第一种情形是决策只涉及单页。比如某篇内容是否继续保留、某个页面的标题是否准确表达主题,这类判断依赖对内容的理解,脚本无法替代。适用前提是页面数量少、改动频率低。一旦同类判断每周要重复几十次,就该把判断标准写成清单,交给规则执行,人只处理例外。
第二种情形是判断依据来自外部且不稳定。比如封锁类型、访问来源变化、平台侧的限制,这些信息每次都要重新确认,手工核实比写死规则更可靠。退出条件是:当同一类判断反复出现且结论一致,就可以固化成检查项,减少重复确认。
一个假设例子:站点有三百个页面,其中五十个需要定期检查是否仍可访问。手工逐个打开,一轮要花很长时间;改成脚本批量请求状态码,只把异常结果交给人看。动作变了,下一步也随之变化——人不再花时间确认正常页面,而是集中处理异常清单。这里的关键不是脚本多强,而是把“确认正常”和“处理异常”分开。
不适合继续手工,不等于全部交给工具。更现实的做法是把手工流程拆成“判断标准”和“执行动作”两层。判断标准由人定,执行动作交给脚本或模板。
这样做的结果是:人的时间从执行转移到校验。如果校验发现规则误判,说明判断标准还需要细化,下一步应改标准而不是加人手。如果规则稳定,就可以扩大适用范围。
有些手工工作不仅低效,还会误导判断,可以考虑直接停掉。比如为了“看起来收录正常”而逐页提交、为了凑数量而批量生成近似页面、为了盯排名而每天手工记录同一批词。这些动作的产出很难对应到实际决策。
停掉的前提是:这项工作没有明确的下一步动作。如果记录排名之后既不调整内容也不调整结构,记录本身就只是消耗。反过来,如果某项手工检查会直接触发改标题、改内链或下线页面,就值得保留,直到它能被规则替代。
需要说明的是,抓取、索引、排名是不同环节。批量提交或状态检查出现异常,不能单独证明封锁处理正确或错误,也可能是服务器响应、robots 设置、页面质量等原因。看到异常时,先确认它属于哪个环节,再决定是继续手工核查还是改成规则处理。
面对“继续手工、改写成规则、直接退出”三种选择,可以用三条依据快速定位:
三条依据冲突时,以“是否有明确下一步动作”为先。因为无论手工还是自动,最终都要落到一个可执行的决定上;没有决定,工具和人力都只是空转。规模扩大后最该做的,不是把所有事情自动化,而是把没有下一步的手工动作先停下来。