【发布时间】:2021-03-18 09:45:23
【问题描述】:
来自https://www.crummy.com/software/BeautifulSoup/bs4/doc/#output-formatters,它说
如果你给 Beautiful Soup 一个包含 HTML 实体的文档,比如 “&lquot;”,它们将被转换为 Unicode 字符:
soup = BeautifulSoup("&ldquo ; Wow!&rdquo ; 他说。", 'html.parser')
str(汤)
'“哇!”他说。'
有什么方法可以修改这种行为并使其保留'&dlquo;'、'”'或'"'等实体 strong> 用 BeautifulSoup 处理 html 或 xml 的字符串?
【问题讨论】:
标签: python beautifulsoup