【发布时间】:2012-03-02 05:17:11
【问题描述】:
所以这本质上是Finding duplicate records 的后续问题。
我们每天都从文本文件中导入数据,最后我们两次导入了分布在 182 个文件中的 10163 条记录。在运行上述查询以查找重复项时,我们获得的记录总数为 10174,比文件中包含的记录多 11 条。我假设有 2 条记录完全相同,并且在查询中也是有效的记录。所以我认为最好使用时间戳字段并简单地查找今天运行的所有记录(因此最终添加了重复的行)。我通过以下查询使用了 ORA_ROWSCN:
select count(*) from my_table
where TRUNC(SCN_TO_TIMESTAMP(ORA_ROWSCN)) = '01-MAR-2012'
;
但是,计数仍然更多,即 10168。现在,通过在包含所有文件的文件夹中运行以下命令,我很确定文件中的总行数为 10163。 wc -l *.txt.
是否有可能找出哪些行实际上被插入了两次?
【问题讨论】:
标签: oracle11g