【问题标题】:In Linux, how to find files with modification dates NOT older than a given file?在 Linux 中,如何查找修改日期不早于给定文件的文件?
【发布时间】:2016-04-28 23:00:46
【问题描述】:

根据 GNU,修改日期似乎只精确到第二级。我有一个非常高速的系统,可以生成大量文件到目录(以毫秒速率)。我正在尝试监视生成的新文件,并将文件名显示到终端。

目前,我正在使用

touch .file
sleep 1
find -type f -newer .file

查找在创建.file 之后修改的文件。但是,由于系统以非常高的频率运行,find 中的 -newer 选项似乎无法捕获与新的 touched .file 在同一“时间”(精确到秒)修改/创建的文件.为了详细说明我的意思,假设我触摸了01:02:03 AM 处的文件,在01:02:03:02 AM 处生成一个新文件(.file 之后的 02 毫秒)。 find 会忽略毫秒,并断定它们是同时创建的。结果,这个新文件不是newer 而不是.file,因此被忽略了。

有什么办法?我正在考虑使用! -older,不幸的是find 没有这样的选项。我想避免编写自己的find 版本以节省代码大小。有什么建议吗?

【问题讨论】:

  • -not 呢?
  • 修改时间不是也不应该被视为原子事务 ID。您能否移动/重命名已处理的文件,以便始终知道哪些文件处于待处理状态?
  • @thatotherguy 我真的很喜欢这个主意。不幸的是,这些文件应该保持只读状态。有没有其他方法可以在不接触文件的情况下“标记”文件?
  • 您可以触摸不同目录或具有不同扩展名的虚拟文件,例如for file in *; do if [[ -f ~/processed_files/$file ]]; then echo "Already processed"; else process "$file"; > ~/processed_files/$file; fi; done.

标签: linux bash filesystems listener timing


【解决方案1】:

最好的办法是生成带有 id 的文件名,并基于它使用 find´s 过滤器。

回到你的问题,你可以试试这个:

touch .file
find . -type f -printf "%T@ %p\0" |\
  awk -v RS="\0" -v reftime=$(find . -name .file -printf "%T@") \
      '$1>=reftime {print substr($0,index($0," ")+1)}'

%T@ %p\0 打印自 1970 年 1 月 1 日 00:00 GMT 以来的最后修改时间(以秒为单位),带有小数部分。后跟一个空格和文件的文件名。

\0 用作分隔符以提高安全性:当文件名包含特殊字符 \n " 等时,命令不会中断。

awk用于比较最后修改时间,打印最后修改时间大于等于.file最后修改时间的文件名

感谢printf,每条记录都是time + + filename。当然,$1 将是第一个字段:最后修改时间。

在我对 debian 的测试中,%T@ 次有一个固定长度。我可以用22替换index($0," ")+1

在我的 debian 上,小数部分始终为 0(可能是精度问题),因此在我的情况下,所有上次修改时间与 .file 在同一秒内的文件都将被打印:即使是之前创建的文件.file 在同一秒内。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2017-01-02
    • 2021-12-08
    • 2012-02-08
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多