【发布时间】:2018-05-07 14:59:57
【问题描述】:
tl;dr:如何使用 pcregrep 拆分每个多行匹配?
长版本:我的文件中有些行以(小写)字符开头,有些以数字或特殊字符开头。如果我至少有两行以小写字母开头,我希望在我的输出中使用它。但是,我希望每个发现都被分隔/拆分,而不是相互附加。 这是正则表达式:
pcregrep -M "([a-z][^\n]*\n){2,}"
所以如果我给一个这样的文件:
-- Header --
info1
info2
something
< not interesting >
dont need this
+ new section
additional 1
additional 2
给出的结果是
info1
info2
something
additional 1
additional 2
然而,我想要的是这样的:
info1
info2
something
additional 1
additional 2
这可能和/或我必须开始使用 Python(或类似的)吗?即使建议从这里开始使用其他东西,首先知道它是否可能仍然很高兴。
谢谢!
【问题讨论】:
标签: regex split pcre multiline pcregrep