【发布时间】:2016-05-11 16:11:41
【问题描述】:
我正在尝试抓取this webpage。此代码有效:
import requests
header = {
'user-agent': 'Mozilla/5.0 (Macintosh; Intel Mac OS X 10.9; rv:32.0) Gecko/20100101 Firefox/32.0',
}
r = requests.get('http://www.machinefinder.com/ww/en-US/categories/used-drawn-planters', headers=header)
print r.text
但我不确定它返回的文本到底是什么。我希望它是 JSON,这样我就可以复制我发现的解析 JSON 的其他示例。
注意:我的工作安全阻止了网页,并在我使用时显示“非法 Web 浏览器”
header={
'Content-Type': 'application/json;charset=UTF-8',
}
这就是我改用 Firefox 的原因。
【问题讨论】:
-
检查
r.headers['content-type']的类型。如果我不得不猜测的话,可能是text/html。 -
可以根据请求取回json
标签: python json python-requests