【发布时间】:2016-02-15 01:35:24
【问题描述】:
我有大量文件偶尔会有不同名称的重复文件,我想在文件系统中添加类似 fslint 的功能,以便对其进行重复数据删除,然后检查在指定位置创建的任何新文件针对已知的 md5 值。目的是在整个文件集合的初始求和之后,开销较小,因为它只需要将新文件的 md5 总和与现有总和的存储进行比较。此检查可以是日常工作,也可以作为文件提交过程的一部分。
checkandsave -f newfile -d destination
这个实用程序是否已经存在?存储 fileid-md4sum 对以尽可能快地搜索新文件的总和的最佳方法是什么?
r.e.使用 rmlink:
rmlink 将校验和存储在哪里,或者每次运行都会重复这项工作?我想将校验和添加到文件元数据(或某种形式的优化搜索速度的存储)中,这样当我有一个新文件时,我会生成它的总和,并根据现有的预先计算的总和检查它,对于相同的所有文件大小。
【问题讨论】:
标签: linux filesystems duplicates md5sum