先给结论:批量交付变差时,抽查不能按试做阶段的同一套标准平均取样,而要按“谁执行、哪一批、什么时间”分层,重点检查试做样本与批量样本之间的差异点。如果差异集中在执行人、批次时间或页面类型上,问题多半出在流程复制;如果差异分散且没有规律,才更可能是需求本身或验收标准不清。
试做阶段通常由最熟悉业务的人完成,选的是结构清晰、竞争适中、已有一定权重的页面。批量交付则换成普通执行者,覆盖大量新页面或低权重页面。表现变差至少有两种成立条件不同的解释:
两种解释对应的动作完全不同。前者要改流程和培训,后者要重设预期和验收口径。不做区分就直接加大执行力度,往往只是把偏差放大。
把批量交付的页面按三个维度分组,再对照试做样本:
假设有 20 个批量页面,其中 12 个由同一人完成且表现接近试做水平,另外 8 个分散在两人手里且明显偏弱。这种分布更支持“流程复制失败”,因为差异跟着执行人走,而不是跟着页面起点走。反之,如果所有批次都均匀变差,且批量页面普遍是全新域名下的低权重页,就更可能是样本不可比。
抽查的目的不是得出一个平均分,而是尽快定位偏差来源。可以按下面的顺序执行:
一个实际动作是:先只抽查每个执行人的首个批次,记录动作完成情况。如果首个批次就明显走样,说明问题在培训或需求传达,下一步应暂停批量、先修正交付说明;如果首个批次正常而后续批次变差,下一步应检查排期和复核环节是否被跳过。这个动作的结果会直接决定是改人、改流程,还是改验收标准。
试做阶段的好表现,只在“执行人熟练、样本占优、检查充分”这三个条件同时成立时才有参考价值。批量交付只要打破其中任意一个,就不能直接套用试做结论。因此,批量抽查时不要问“为什么没达到试做水平”,而要问“试做时的哪个条件在批量阶段消失了”。
如果消失的是检查环节,就补检查点;如果消失的是样本优势,就调整验收基线,把批量页面的合理预期单独写清。把这两件事混在一起,会让执行者为了追平试做数字而做表面动作,反而掩盖真实问题。
抽查结束后,用一条简单规则决定下一步:差异跟着人走,就先解决执行一致性;差异跟着批次走,就先解决排期与复核;差异跟着页面类型走,就先解决需求与模板。只有当差异没有规律、且动作完成情况普遍正常时,才需要回到样本可比性上重新评估。这样,抽查才不只是发现问题,而是直接指向该改哪里。