先给结论:账号权限不同导致结果不同,通常不是工具算错了,而是两次查询覆盖的文本范围不同。核对时不要盯着密度数字,而要先把“这次统计到底读了哪些内容”复现出来。可行的做法是分别导出两次查询的文本范围清单,逐项比对差异;如果差异来自权限可见的正文区域,就以更完整的那个账号为基准重新统计,再决定旧内容保留、改写还是退出。
同一套关键词密度工具,对同一页面给出不同密度,常见原因有三类:一是权限不同,能读到的字段不同,比如一个账号只能看到标题和摘要,另一个能看到正文、评论或历史版本;二是抓取时点不同,页面在此期间被改过;三是统计口径不同,比如是否计入导航、页脚、图片替代文本。
区分方法很直接:让两个账号分别导出被统计的文本,而不是只导出密度值。假设甲账号导出的是“标题+摘要”,乙账号导出的是“标题+摘要+正文”,那么乙的密度被正文稀释或抬高都属正常,与算法无关。如果两份文本完全一致而密度仍不同,才需要怀疑版本或口径问题。
为了让比对可复现,建议固定以下三点,再去看数字:
固定之后,把两次导出的文本做一次差异比对。差异清单就是权限影响的直接证据,也是下一步取舍的依据。若无法导出文本,只能看到密度值,那么这个结果不足以支撑保留或退出决策,应先想办法拿到范围信息。
范围核对清楚后,取舍逻辑会变得具体:
保留适用于两种情况。一是低权限账号看不到的部分本身就与主题无关,比如评论或页脚,它被计入后只是稀释了密度,正文质量并未受影响;二是完整范围下的密度处在合理区间,说明旧内容的核心表述仍然成立,只是需要小幅调整。此时动作是记录基准范围,后续复查沿用同一账号,避免再次出现范围漂移。
改写适用于完整范围下密度明显偏高、且高密度集中在少数段落的情况。这时不必整篇推翻,先定位到被重复堆叠的段落,替换同义表达或拆分句子,再以完整权限账号重新统计。改写的判断依据是范围清单里“高密度段落”的分布,而不是单看总密度。
退出适用于两种前提。一是旧内容在完整范围下已经偏离当前主题,继续保留只会让统计口径混乱;二是该内容依赖的旧系统或旧合作关系已经无法提供完整文本,导致范围永远无法核对。退出前建议先导出一次完整文本留档,否则后续无法判断退出是否正确。
这个流程的关键在于:先让范围可见,再让取舍有据。需要说明的是,工具的具体权限设置、导出字段和统计口径因产品而异,实际使用时请以你所用工具的当前说明为准,不要假定不同工具的范围完全一致。若某项导出功能不存在,就改用人工圈选文本的方式补齐范围信息,同样能达到核对目的。
最后提醒一点:密度数字下降本身不能证明内容变好,它也可能只是范围扩大后分母增加。只有当范围清单和段落分布同时支持你的判断时,保留、改写或退出的决定才算站得住脚。