【发布时间】:2013-06-19 16:57:53
【问题描述】:
我正在尝试登录 Reddit 并获取我自己的帐户数据。
这是我的 Python 代码:
from pprint import pprint
import requests
import json
username = 'dirk_b'
password = 'willnottell'
user_pass_dict = {'user': username,
'passwd': password,
'api_type': 'json',
'rem': True, }
headers = {'dirkie': '/u/dirk_b API python test', }
client = requests.session()
client.headers = headers
r = client.post(r'http://www.reddit.com/api/login', data=user_pass_dict)
j = json.loads(r.content.decode());
client.modhash = j['json']['data']['modhash']
s = client.post(r'http://www.reddit.com/api/me.json', data=user_pass_dict)
pprint(s.content)
我得到的响应是:b'{"error": 404}'
如果我在没有 .json 部分的情况下执行相同的请求。我得到一堆 HTML 代码,内容为“reddit.com:找不到页面”。所以我假设我对 URL 做错了什么。但我使用的 URL 是在 Reddit API 中指定的。
我不使用 PRAW 的原因是因为我最终希望能够在 c++ 中执行此操作,但我想确保它首先在 Python 中工作。
【问题讨论】:
-
为什么是
r.content.decode()?json库处理为你的解码。json.loads(r.content)很好;或者,使用stream=True到client.post()并使用json.load(r.raw)直接从http 套接字读取库(如果数据被压缩,可能无法正常工作)。 -
另外,
client.modhash是什么?这不会传递给服务器。 -
在 3.3 中没有 .decode 就无法工作 - decode() 将其解码为 UTF-8。