【发布时间】:2019-11-01 04:49:36
【问题描述】:
...
<div class="article_header">
...
<a href="abc" title="PDF">XXX</a>
...
</div>
...
鉴于上述 XML,我只想打印“abc”。我可以在 python 中使用 lxml 来做到这一点。但这涉及制作一个python程序。我想要更像一个衬里的东西(就像 awk 一个衬里比 python 更容易处理 TSV 文件)来提取这样的短信息。
有没有工具可以做到这一点?谁能告诉我最简单的方法是什么?
【问题讨论】:
-
如何制作一个 Python 程序来执行您所描述的操作 - 接受输入和 XPath 并输出结果?要求工具推荐或其他场外资源超出了 Stack Overflow 的范围。
-
What topics can I ask about here? 明确表示,要求我们推荐或查找工具、软件库或其他场外资源的问题在这里是题外话。
标签: xml command-line lxml