【发布时间】:2020-08-20 09:31:27
【问题描述】:
我有一个包含许多这样的行的文档:
<tr><td width="10%">doc_no_320F0321</td><td width="5%">116</td><td> bla bla bla 1976, bla bla point (2) bla bla bla. </td><td> bla bla bla 1976, bla bla point (1) bla bla bla. </td></tr>
(美化后它看起来像这样:
<tr>
<td width="10%">doc_no_320F0321</td>
<td width="5%">116</td>
<td> bla bla bla 1976, bla bla point (2) bla bla bla. </td>
<td> bla bla bla 1976, bla bla point (1) bla bla bla. </td>
</tr>
)
我需要做的是检查第三个和第四个 为此,我尝试用 突出显示它们,以便更容易看到它们。
我正在运行这个 sed 替换: 但它只围绕每行的最后一位数字。 有人可以帮我把第三个和第四个标签中的所有数字组合括起来吗? 谢谢。 【问题讨论】:的数字是否相同,忽略其他字符。
sed -i -r 's|(<td>.*?)([[:digit:]]+)(.*?<\/td>)|\1<mark>\2<\/mark>\3|g'
mark,为什么您需要标记它们?
中”,而不是“能够使用正则表达式找到它们”。那里的术语有误...谢谢,我将进行编辑以使其更清晰。