结论先行:额度有限时,优先选“能产生分歧、且分歧可以被核对”的样本,而不是选流量最大或最熟悉的页面。具体做法是:先列出多个角色对同一事实的不同理解,再把每种理解转成可核对的项目,最后只查那些“查完能直接改变下一步动作”的样本。如果样本查完只能确认大家都已经认同的事实,那它就不值得占用额度。
信息量不等于数据量。一个样本值得查,通常要满足两个条件之一:一是不同角色对它的判断存在冲突,二是查完之后能排除掉一种后续做法。比如运营认为某栏目页收录正常,技术认为该页被模板问题挡住,这两种理解必须靠一次查询来裁决——这类样本的信息量就高。
反过来,如果全组都同意某页表现差,查了也只是重复已知结论,那它应该排在后面。挑选样本时可以先问一句:这次查询的预期结果,会不会让我们少做一件事,或者改做另一件事?如果答案是否定的,就暂时不查。
多个角色对同一事实理解不同时,不要直接争论,而是把各自的说法写成可核对的条目。假设一个团队对“栏目页是否被正常处理”有分歧,可以拆成:该页是否可被抓取、是否有重复内容指向同一主题、内链是否把它当作重要入口。每一项都对应一种可查询的观察点。
拆完之后,挑选那些“两种说法指向不同动作”的条目。例如:
这样做的实际结果是:你手里的额度会从“按页面数量分配”变成“按待裁决的问题分配”,下一步动作也随之明确——要么修,要么继续,要么换样本。
假设一个内容团队对三件事有分歧:首页是否被正常索引、某篇旧文是否仍在参与搜索、某栏目页是否因为内链太少而被忽略。三个角色分别给出不同判断。此时不必三个都查。
先查“旧文是否仍在参与搜索”,因为它的结果直接决定要不要重写或合并;再查“栏目页是否被内链当作入口”,因为结果决定要不要调整导航。首页的判断如果三个角色一致,且没有其他证据冲突,就可以先不查。这里的关键不是样本数量,而是每个样本是否对应一个待裁决的分歧。
需要说明的是,以上数字和场景都是假设,用来演示比较方法,不代表任何真实项目的数据或结论。
一个反例是:当分歧本身来自对“查询结果含义”的不同理解,而不是对页面事实的不同理解时,挑样本并不能解决问题。比如两个人对“收录量下降”的解释不同,一个认为是正常波动,另一个认为是处理出了问题。此时即使查出某个页面的状态,也无法裁决争论,因为争论的对象是趋势解释,不是单页事实。
遇到这种情况,应该先统一“用什么证据来定义正常波动”,再决定查什么。否则额度会被用在无法收敛的分歧上。另一个失效条件是:待查项目之间高度相关,查一个就能推断另一个,此时多查只是重复。
把上面几步合成一个可执行动作:在查询之前,先写一张裁决清单,列出“分歧点—可核对项目—查完后的两种动作”。然后按“查完能改变动作”的程度排序,只把额度给排在前面的样本。执行一次之后,回看哪些查询真的改变了下一步,哪些只是确认了已知事实;下一次挑选样本时,就按这个反馈调整清单。
如果一次查询后分歧仍未收敛,不要继续加查同类样本,而是回到清单,检查是不是把“趋势解释”误当成了“单页事实”。这一步会直接影响后续额度的分配方式,也是额度有限时最值得保留的习惯。