【发布时间】:2020-05-02 12:33:10
【问题描述】:
我有以下代码,它为我提供了 Example.html 文件中的数据。但我必须逐行读取数据
html_doc = open("Example.html","r")
soup = BeautifulSoup(html_doc, 'html.parser')
print(soup.get_text())
【问题讨论】:
-
您能添加您的预期输出吗?
-
假设下面是 HTML 文件中的文本 一只口渴的乌鸦飞进村庄寻找水源。乌鸦飞过房屋、田野和树木。乌鸦把嘴伸进水罐里,却够不着水。水位太低,狭窄的开口阻止了他的脖子一直向下预期输出:我必须先阅读第一行,而不是比较第一行是否包含“防止”一词。如果它包含如果不读取下一行并进行比较,则执行某些操作。比较我可以,但我不知道如何逐行阅读文本。
-
HTML 文件中的“行”是什么意思?物理行,由
\n? 分隔分开<p>内容?在您当前的本地浏览器窗口中,使用您当前的字体和大小的文本行被您的浏览器打断了吗? -
行由 分隔
标签: python beautifulsoup