【问题标题】:&lt; converted to < when parsing with beautiful soup< 用美汤解析时转换为 <
【发布时间】:2019-04-01 15:54:11
【问题描述】:

我正在使用美丽的汤来解析包含&amp;lt;br&gt; 的字符串,美丽的汤将其解释为&lt;br&gt;

有没有办法让我得到漂亮的汤来停止这样做,以便 &amp;lt;br&gt; 保持不变并被视为普通字符串,而 &lt;br&gt; 被正常解析?

【问题讨论】:

    标签: python beautifulsoup html-escape-characters


    【解决方案1】:

    您可以使用formatter="html" 让解释器知道它是原始html。基本上,如果您使用formatter 选项,您可以获得您所期望的。 documentation 有关于它的详细信息。

    【讨论】:

    • 我无法立即看到如何应用它。使用soup.prettify(formatter="html") 仍然给我&lt;br&gt;,而且我没有在我的代码中使用编码或解码函数。
    • 似乎只为编码、解码和美化功能设置了格式化程序选项,这些功能都应用于已解析的文档。我想停止的行为是在解析过程中发生的,所以为时已晚。我目前的解决方法是用其他字符替换&amp;lt;,并在我使用完美汤后反转替换。
    猜你喜欢
    • 1970-01-01
    • 2011-04-20
    • 2017-09-29
    • 2020-11-23
    • 2014-08-11
    • 2013-04-29
    • 2018-05-08
    • 2012-10-05
    • 1970-01-01
    相关资源
    最近更新 更多