【发布时间】:2020-04-30 13:53:13
【问题描述】:
我有 html 字符串,想找到文本元素并用标记替换。我使用 beautifulsoup 来获取数据,但 get_text 只给出文本而不是相应的元素。如何遍历从根节点到最后一个节点的 html 字符串并找出要替换为我定义的标记的文本元素。 我从源代码中获取动态大 html 字符串。已经给出了一个小例子
<html>
<body>
<p>Hi</p>
<p>Hello</p>
</body>
</html>
To
----
<html>
<body>
<p>Token1</p>
<p>Token2</p>
</body>
</html>
【问题讨论】:
-
我想这就是你要找的。 stackoverflow.com/questions/36108621/…
-
这能回答你的问题吗? Get all HTML tags with Beautiful Soup
标签: python python-3.x html-parsing html-parser