【发布时间】:2019-04-01 15:54:11
【问题描述】:
我正在使用美丽的汤来解析包含&lt;br> 的字符串,美丽的汤将其解释为<br>。
有没有办法让我得到漂亮的汤来停止这样做,以便 &lt;br> 保持不变并被视为普通字符串,而 <br> 被正常解析?
【问题讨论】:
标签: python beautifulsoup html-escape-characters
我正在使用美丽的汤来解析包含&lt;br> 的字符串,美丽的汤将其解释为<br>。
有没有办法让我得到漂亮的汤来停止这样做,以便 &lt;br> 保持不变并被视为普通字符串,而 <br> 被正常解析?
【问题讨论】:
标签: python beautifulsoup html-escape-characters
您可以使用formatter="html" 让解释器知道它是原始html。基本上,如果您使用formatter 选项,您可以获得您所期望的。
documentation 有关于它的详细信息。
【讨论】:
soup.prettify(formatter="html") 仍然给我<br>,而且我没有在我的代码中使用编码或解码函数。
&lt;,并在我使用完美汤后反转替换。