【发布时间】:2015-01-10 10:48:15
【问题描述】:
我有以下 XML 文件:
<PARENT_TAG>
<CHILD_TAG>
<DETAIL_1_TAG></DETAIL_1_TAG>
<DETAIL_2_TAG></DETAIL_2_TAG>
<DETAIL_3_TAG></DETAIL_3_TAG>
<DETAIL_4_TAG></DETAIL_4_TAG>
</CHILD_TAG>
</PARENT_TAG>
甚至可以格式化为
<PARENT_TAG><CHILD_TAG><DETAIL_1_TAG> ... </CHILD_TAG></PARENT_TAG>
我想使用 grep、awk、sed 提取 xml 标记的名称。 在这种情况下,我会提取“CHILD_TAG”。
【问题讨论】:
-
不清楚您的预期输出是什么。此外,使用 awk/sed 解析 xml 并不是最好的主意:考虑使用适当的 xml 解析器。
-
extract the name of the xml tag following什么?<PARENT_TAG>?该块是否在您的输入文件中出现一次或多次?<PARENT_TAG>可以出现在您不想提取它后面的标签的其他上下文中吗?它可以在<...>中有任何关联的属性吗?如果可能发生任何此类或任何其他差异,请修改您的示例输入以显示这一点,并在任何情况下发布您的预期输出。