【发布时间】:2016-02-03 00:03:19
【问题描述】:
我想将网页(所有内容)保存为文本文件。 (好像您确实右键单击网页 -> “另存为” -> “另存为文本文件”,而不是作为 html 文件)
我已尝试使用以下代码:
import urllib2
url=''
page = urllib2.urlopen(url)
page_content = page.read()
file = open('file_text.txt', 'w')
f.write(page_content)
f.close()
我的目标是能够在没有 html 代码的情况下保存整个文本。 (例如我想读“è”而不是“é”)
【问题讨论】:
-
一件事——你打开'file',但写入并关闭'f'。名称需要一致。