【问题标题】:How do I get the HTML of a web page if I have the url in python [closed]如果我在 python 中有 url,如何获取网页的 HTML [关闭]
【发布时间】:2014-06-15 23:53:03
【问题描述】:

假设我有这个网址:https://www.python.org/ 我想将页面的源下载到一个名为 python_source.txt 的 .txt 文件中

我该怎么做?

【问题讨论】:

  • 这怎么能得到支持?
  • 网络搜索是你的朋友
  • 在 Python 中有很多方法可以读取 url 的内容。把它们都放在这里没有坏处。
  • Stack Overflow 不是免费的代码设计和编写服务。您需要付出一些努力才能自己完成这项工作,然后才能期待我们提供任何帮助。就目前而言,您的问题可能会被否决并关闭,因为您没有进行足够的研究。

标签: python file url


【解决方案1】:

python 包urllib 就是这样做的。该文档提供了一个非常清楚的示例,说明您想要做什么。

import urllib.request
local_filename, headers = urllib.request.urlretrieve('http://python.org/')
html = open(local_filename)

【讨论】:

    【解决方案2】:

    使用 urllib2,它是这样做的:

    response = urllib2.urlopen(url)
    content = response.read()
    

    现在您可以将内容保存在任何文本文件中。

    【讨论】:

    • 该死.. pyhton 拥有一切..
    猜你喜欢
    • 2013-03-09
    • 2015-01-19
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-04-12
    • 2015-01-02
    • 1970-01-01
    • 2020-07-12
    相关资源
    最近更新 更多