先定义一行代表什么,再开始文本对比
两份名单要找漏项,先让每一行只代表一个可以核对的对象。例如报名表可用一个邮箱地址一行,发货清单可用一个订单号一行,库存列表可用一个 SKU 一行。标题、导出时间、页脚和备注如果不属于比较对象,应在复制前去掉;否则它们会制造无意义的差异。
比如把昨天和今天的报名名单放在一起时,今天多出一行 张敏 138...,昨天则有一行 张敏 139...。姓名相同并不能说明是同一个人,也不能直接认定号码被改错。先确认你使用的是同一活动、同一状态筛选和同一导出范围;不同筛选条件比“名单自己丢了一行”更常见。
将两份稳定副本粘贴到 文本对比工具(text-diff)的“原始版本”和“修改版本”中。工具提供按行、按单词和按字符三种模式。名单和日志通常先用按行模式;只有确认是同一条记录的细小改动时,才用按单词或字符模式观察具体位置。
用高亮建立复核清单,不要把它当最终结论
按行对比会把左侧独有内容显示为删除、右侧独有内容显示为增加。它比较的是你粘贴的文本及其顺序,并不知道“王小明”和“王小明(已付款)”是否属于同一人。排序变化也可能让一条记录看起来像被删除后又新增。
处理报名名单时,可以把每一个高亮分成三类:只在旧名单出现、只在新名单出现、两边都有但内容不同。先在原系统中查订单号、邮箱或手机号末几位等合适的唯一标识,再决定是否补录、合并或联系相关人员。涉及个人信息时,不要把完整名单贴到不必要的群聊或公开文档中。
若数据原本来自 CSV,可先用 CSV 预览工具 检查列名、分隔符和是否有整列错位。文本对比无法理解 CSV 的列结构;一行中多了一个逗号、换行符或引号,都可能让后续行看起来全部不同。
处理重复和换行拆分时,回到原始记录确认
“重复”有两种常见情况:完全相同的一行出现两次,或同一对象因为备注、空格、电话号码格式不同而出现两条近似记录。前者可以先标记;后者仍要查原始记录,不能只凭文本外观删除。尤其是同名用户、家庭订单和代报名,可能本来就应当保留两行。
另一个容易误判的情境是地址或备注被拆成两行。一条完整记录在右侧变成两行后,对比结果会同时出现删除和两条增加。此时先检查复制来源是否自动换行、是否从表格单元格跨行粘贴,再回到导出文件判断数据是否真的变动。
完成处理后,保留两份原始导出和一份写明处理时间、筛选条件、确认人及结论的复核记录。可以用 字数统计工具 粗看复制前后的行数或字符变化,但它不能替代逐项确认。重要名单的最终依据仍是原始系统中的记录。
常见问题
两份列表顺序不同,为什么几乎每行都被标成差异?
按行对比会保留顺序信息。先将两边按同一个唯一字段排序,或把比较范围缩小到同一批记录,再判断哪些内容确实新增、删除或修改。
高亮的删除行是不是已经从系统里删掉了?
不是。它只表示这段文字没有出现在你粘贴到右侧的版本中。请到原始系统检查筛选条件、导出时间和记录状态后再下结论。
同名但手机号不同,应该算重复吗?
不能只按姓名判断。应使用适合业务的唯一标识,并查看报名时间、订单号或联系方式等原始记录;同名的人可能是不同对象。
可以把整份含有个人信息的名单贴进工具吗?
先遵循单位的数据处理规则,并尽量只保留排查所需字段。对外共享差异结果前还要再次确认,避免把电话、地址或其他敏感信息带出原始处理范围。