【发布时间】:2021-03-17 14:22:29
【问题描述】:
我想从以下网址下载文件:
url = "https://www.nseindia.com/companies-listing/corporate-filings-actions"
# Download(.csv) is the element I have to click.
# the following code doesn't work.
header = {
'User-Agent': 'Mozilla/5.0 (X11; Ubuntu; Linux x86_64; rv:65.0) Gecko/20100101 Firefox/65.0',
"X-Requested-With": "XMLHttpRequest"
}
r = requests.get(url, stream=True, timeout=20, headers=header)
with open("/home/pms/corp_action", 'wb') as fd:
for chunk in r.iter_content(chunk_size=chunk_size):
fd.write(chunk)
# The element on inspection
<a id="CFcorpactionsEquity-download" data-url="" href="javascript:downloadCSV('CFcorpactionsEquity-download')"><img src="/assets/images/icon-xls.svg" alt=""> Download (.csv)</a>
我正在尝试弄清楚如何使用请求来下载文件,并且我非常有兴趣了解如何识别正确的 params 或实现此目的所需的其他内容。
【问题讨论】:
-
“不起作用”到底是什么意思。您是否收到错误,没有任何反应,文件是否有错误的输出?
-
@mousetail 我得到一个包含
head和body的文件基本上说:找不到资源。 -
请尽量避免在您的帖子中添加“TIA”和其他闲聊内容。
-
我有时会提供以下建议:请注意,我们更喜欢这里的技术写作风格。我们轻轻地劝阻问候,希望你能帮助,谢谢,提前感谢,感谢信,问候,亲切的问候,签名,请你能帮助,聊天材料和缩写 txtspk,恳求,你多久了被卡住、投票建议、元评论等。只需解释您的问题,并展示您尝试过的内容、预期的内容以及实际发生的情况。
标签: javascript python python-requests