【发布时间】:2011-10-14 19:11:57
【问题描述】:
我是 Python 的新手,我的老板给我一个任务来做这件事:
- 通过 pycurl 连接从 twitter 获取流数据并以 JSON 格式输出
- 使用 NLTK 和正则表达式进行解析
- 将其保存到数据库文件(mySQL)或文件库(txt)
注意:这是我要获取的网址 ('http://search.twitter.com/search.json?geocode=-0.789275%2C113.921327%2C1.0km&q=+near%3Aindonesia+within% 3A1km&result_type=recent&rpp=10')
有没有人知道如何使用上述步骤从 twitter 获取流数据?
您的帮助将非常感激:)
【问题讨论】:
标签: regex streaming real-time nltk pycurl