先查分母,不要先查算法。分组结论与总体相反,最常见的原因是总体指标被一个规模极大的分组或口径不同的流量层拉偏,而不是某个分组真的出现了反向规律。你要做的是把每个分组的分子、分母和它们占总体分母的比例列出来,看总体值是否由某一组主导。
假设你把旧内容按栏目分组,统计“有搜索展现的页面占比”。总体是 20%,但 A 栏目 45%,B 栏目 8%。总体低于大多数分组,往往不是算法对整体变差,而是 B 栏目页面数占总体七成,把总体拉低。此时要查的是各栏目页面数占全站页面数的比例,而不是继续比较点击率。
另一种相反来自口径混入。比如总体统计包含已被 noindex 的旧页面,分组统计却只看了仍可访问的页面。两边的分母不是同一批 URL,结论当然相反。查分母时先确认三件事:分母是 URL 数、请求数还是展现数;统计时间窗口是否一致;是否排除了重定向、参数页和已下线条目。
如果旧内容、旧系统或旧合作关系需要退出,但其中仍有部分价值,分组结论与总体相反时,先按“保留价值是否集中在少数分组”来分条件。
条件一:价值集中在少数分组,总体被低价值大分组拖低。这时不要按总体结论整体退出。动作是保留高价值分组,只对低价值大分组做收缩。例如先导出各组 URL 数、有效展现数、有效点击数和最后访问时间,把占总体分母超过一半、但有效展现占比很低的分组标出来。下一步只对这些 URL 做合并、下线或改版,观察总体分母缩小后总体值是否回升。如果回升,说明之前是分母结构问题;如果不回升,再查剩余分组的质量。
条件二:各分组价值接近,总体与分组相反来自统计口径。这时不要急着退出任何分组。动作是把总体和分组改成同一套口径重算:同一时间窗口、同一 URL 集合、同一排除规则。重算后若总体仍与分组相反,再检查是否存在跨分组的重复计数,比如同一 URL 同时属于两个栏目,被计入两个分组却只在总体算一次。处理重复归属后再决定退出范围。
查分母的证据链可以按下面顺序走,每一步都记录原始数字,避免只记百分比:
完成这五步后,你会得到两种结果之一:总体值由分母结构主导,或总体值由口径错误主导。前者对应收缩低价值大分组,后者对应统一口径后重算。这个动作会直接决定下一步是退出还是保留,而不是先改标题或先提交新页面。
如果分组后结论相反,但各组分母占比接近、口径也已统一,那么相反可能来自真实差异,比如某分组的查询意图与总体不同。这时查分母只能排除统计假象,不能解释差异本身。你需要补充该分组的查询词类型、落地页类型和访问来源,判断是否属于不同需求。若证据仍不足,先保留该分组,设置观察窗口,不要因为总体结论就把它一并退出。
另外,请求量、抓取量或某项统计归零,不能单独证明处理正确。它也可能是抓取预算转移、日志采样变化或统计工具延迟造成的。把归零当作线索,继续核对同一批 URL 在站内统计和搜索报告中的表现,再决定是否扩大退出范围。
最终判断标准不是总体值是否好看,而是你能否说清每个分组的分母来自哪些 URL、这些 URL 是否仍属于要保留的部分。分母查清之后,退出动作才有依据,保留动作也才有边界。