【问题标题】:downloading data using a blob link使用 blob 链接下载数据
【发布时间】:2020-04-13 00:30:38
【问题描述】:

使用来自本网站的数据:https://ourworldindata.org/grapher/total-daily-covid-deaths?tab=map

我正在尝试与链接“total-daily-covid-deaths.csv”进行交互,该链接具有 href 链接“blob:https://ourworldindata.org/b1c6f69e-4df4-4458-8aa0-35173733b364”。单击链接后,我被带到一个包含大量数据的页面,我只是想编写一个 python 脚本来获取这些数据并将其放入一个 csv 文件供我使用。在研究这个时,我发现有大量的信息,我很快就糊涂了。我有使用漂亮的汤和请求进行网络抓取的经验,但是由于 blob 链接不是实际的网站,因此我无法使其正常工作。我希望有人可以为我提供一些启示,并为我指明正确的方向。

这是我正在使用的代码:

import urllib.request as request

url = 'https://ourworldindata.org/grapher/total-daily-covid-deaths?tab=map'
# fake user agent of Safari
fake_useragent = 'Mozilla/5.0 (iPad; CPU OS 6_0 like Mac OS X) AppleWebKit/536.26 (KHTML, like Gecko) Version/6.0 Mobile/10A5355d Safari/8536.25'
r = request.Request(url, headers={'User-Agent': fake_useragent})
f = request.urlopen(r)

# print or write
print(f.read())

【问题讨论】:

    标签: python blob


    【解决方案1】:

    blob url 已在下面的 url 中解释。
    Convert blob URL to normal URL

    您能否分享您的代码-sn-p 以更好地了解您的问题。

    【讨论】:

    • 代码为我提供了 javascript 中的标题和内容,但我仍然不确定如何打开 Blob URL
    • 它指出数据不是来自使用 blob url 的服务器。它从浏览器内存中获取数据。如果您想使用 python 脚本从此类 url 获取数据,最好使用 python selenium。
    猜你喜欢
    • 2013-09-07
    • 2018-01-08
    • 2015-12-06
    • 1970-01-01
    • 2020-04-06
    • 2022-01-15
    • 2013-12-08
    • 1970-01-01
    • 2012-07-24
    相关资源
    最近更新 更多