【发布时间】:2017-09-25 20:02:33
【问题描述】:
我正在尝试从网站自动读取数据,首先我需要填写一些字段,提交表单,然后读取出现的数据。我是新手,但我写了一个显然不起作用的代码,结果是 HTTP 错误 500。我在这里缺少什么?或者我该如何解决这个问题?
另外,我也很高兴使用 BS4 来执行此操作,因为我需要在此代码的基础上进行构建。
网站:http://www.mlindex.ml.com/GISPublic/bin/SnapShot.asp
需要输入:指数代码 = H0A0,基准货币 = LOC,日期 = 09/22/2017
我检查了源代码并浏览了提交 POST 请求的 js 表单并相应地创建了代码和有效负载:
import requests
post_data = {'hdnDate':'1/1/2016', 'hdnAction':'SS', 'hdnSelCurr':'0,LOC', 'hdnCurrDesc':'USD', 'hdnSelTitle':'Hedged', 'txtSSCUSIP':'H0A0'}
# POST some form-encoded data:
post_response = requests.post(url='http://www.mlindex.ml.com/GISPublic/bin/Snapshot.asp', data=post_data)
print post_response
【问题讨论】:
标签: python web-scraping beautifulsoup