【发布时间】:2009-07-02 13:38:30
【问题描述】:
我想使用 grep 查找语料库中的所有标题,我想找到 : 之前的所有内容,然后忽略之后的所有内容。有谁知道这是怎么做到的吗? (能否给我完整的代码行)
【问题讨论】:
-
您能否提供输入和所需输出的示例?
-
输入是一个带有长标题的垃圾邮件列表,输出是一个标题到:如抄送:或收件人:的文件
-
当我到达立方体时会发布我所拥有的
-
这里是我的 grep -h "^[a-zA-Z]*:" * |排序 -u > headers.txt
-
list=
echo *用于 $ 列表中的文件;做; x=egrep -n -m 1 "^$" $file | sed's/://';头 --lines=$x $file | egrep -0 "^[a-zA-Z]*:" |排序 -u > $file.header