先给有条件的结论:如果扫描工具在中断时留下了逐条结果文件或可导出的明细,你可以用“已产出条数 ÷ 计划查询条数”估算覆盖比例,再抽若干条手工复核;如果只留下一个汇总数字或进度百分比,这个比例不能直接当成覆盖范围,因为进度可能包含重试、跳过和重复计数。更稳妥的判断依据是明细记录,而不是界面上的完成度。
要判断已覆盖范围,先分清中断发生在哪一层。常见的有三种:查询队列被停止、网络请求批量失败、导出环节中断。三者的证据价值差别很大。
一个可区分的证据是:明细里是否存在“查询时间 + 关键词 + 结果状态”三列。三列齐全,你可以逐条核对;只有总数没有明细,就只能重新扫描或补扫,不能凭进度条下结论。
假设一次计划扫描 500 个词,中断时日志显示“已处理 320 条”,导出文件只有 180 行。这两个数字的差异通常来自重复计数、失败重试或分页写入未完成。此时不能取 320 作为覆盖数,而应以能打开、能逐行读取的 180 行为基础,再检查这 180 行是否覆盖了不同词、不同页面类型。
可以按下面的顺序核对:
抽检的作用不是证明全部准确,而是判断这批明细能否作为下一步的输入。如果抽检中多数条目与手工结果位置差异明显,说明记录条件(地区、设备、时间)可能不一致,此时覆盖范围即使完整,也不适合直接用于决策。
有一种情况会让“按明细行数算覆盖”失效:工具把每次重试都写成一行,且状态列没有区分首次成功与重试成功。这样 180 行里可能只有 120 个不同关键词,覆盖范围被重复行撑大。判断方法是先按关键词去重,再看去重后的数量;如果去重前后差距很大,就不能用原始行数估算覆盖。
另一个反例是扫描中途更换了查询条件,比如地区从全国改成某城市、设备从桌面改成移动。前后两段结果不在同一口径下,合并计算覆盖范围没有意义。这时应把中断前后的明细分开保存,分别标注条件,再决定补扫哪一段。
确认覆盖范围后,实际动作是把未覆盖词整理成补扫清单,并沿用中断前的查询条件。补扫完成后,将新旧明细按关键词去重合并,再统计整体覆盖情况。这样做的结果是:你得到一份口径一致的明细,下一步无论是做排名变化对比还是定位异常词,都有可追溯的基础。如果补扫后仍有关键词缺失,再考虑调整查询频率或拆分批次,而不是直接全量重跑。
需要提醒的是,具体工具是否支持断点续扫、明细导出格式和去重方式,取决于该工具当前版本,使用前应以工具内实际说明为准,不要凭旧经验假定入口位置或功能仍然存在。