先把结论说清楚:升级后评分变化,通常不是“旧分错了”或“新分更准”这么简单,而是评分口径、数据采样时点和任务配置三者之一发生了位移。要解释差异,最有效的动作是固定其中两项、只让一项变化,再对比同一批对象的前后结果。如果三项同时变,任何解释都只是猜测。
规则评分是一套把若干检查项折算成数值的映射。升级可能改动映射本身,比如某项从“扣分”改为“只提示”,也可能改动数据来源,比如抓取范围、回访频率或解析方式变了。这两类变化的证据形态不同。
区分方法很直接:找到升级前保存的原始条目,用新规则手工折算一次。若手工折算结果等于新分,说明是口径变化;若手工折算仍得旧分,说明是数据变化。这一步的结果决定下一步该改配置还是改内容。
假设某站点有100个页面,升级前平均分72,升级后平均分64。下面两个解释都能成立,不能只看总分就下判断。
解释一:权重口径平移。新规则把某个原本权重较低的检查项调高,而该站恰好在这项上普遍偏弱。此时低分是真实的相对位置变化,内容本身没变,优先级判断需要重排。
解释二:采样漂移。新版本扩大了检查入口或改变了回访时机,导致更多页面被纳入、或同一页面在加载不同阶段被读取,从而暴露出旧版没看到的条目。此时低分不是标准变严,而是覆盖面变宽。
两种解释的应对完全不同:前者要重新排优先级,后者要先确认新增条目是否真的影响用户访问,再决定是否处理。
把分歧转成可核对的项目,需要三类证据。
这三类证据的顺序不能颠倒。先固定对象,再拆单项,最后回到原始条目,才能避免用总分倒推原因。
假设某工具升级后,某站点“结构化数据”一项从满分变为零分,其余各项不变,总分随之下降。此时有两种可能:一是新规则要求更完整的字段,二是新版本读取页面的方式变了,没取到原本存在的标记。
核对方法是查看该页面的原始标记是否仍然存在。若存在且字段完整,则问题在读取环节,应优先核对工具的解析条件,而不是立刻改页面;若标记确实缺失或字段不全,则问题在内容,按新要求补齐即可。这个判断只依赖“原始标记是否存在”这一项事实,不需要参考总分,也不依赖任何搜索量或流量数据。
当多个角色对同一份评分有不同理解时,与其争论哪个版本更准,不如按下面的顺序落地:
这个顺序的价值在于,每一步都产出可被别人复核的记录。如果跳过前两步直接改内容,很可能在处理一个并不存在的问题,而真正影响判断的口径差异被留在原地。具体工具的字段含义、读取条件和版本说明,需要以该工具当前的官方说明为准,不同工具之间不能直接套用。