【问题标题】:How to grab streaming data from twitter connect with pycurl using nltk - regular expression如何使用 nltk - 正则表达式从 twitter 获取流数据连接 pycurl
【发布时间】:2011-10-14 19:11:57
【问题描述】:

我是 Python 的新手,我的老板给我一个任务来做这件事:

  1. 通过 pycurl 连接从 twitter 获取流数据并以 JSON 格式输出
  2. 使用 NLTK 和正则表达式进行解析
  3. 将其保存到数据库文件(mySQL)或文件库(txt)

注意:这是我要获取的网址 ('http://search.twitter.com/search.json?geocode=-0.789275%2C113.921327%2C1.0km&q=+near%3Aindonesia+within% 3A1km&result_type=recent&rpp=10')

有没有人知道如何使用上述步骤从 twitter 获取流数据?

您的帮助将非常感激:)

【问题讨论】:

    标签: regex streaming real-time nltk pycurl


    【解决方案1】:

    我会看pattern:这是一个非常好的网络挖掘库,它还附带了一个 Twitter 挖掘 api。文档也很好。

    否则,请查看https://dev.twitter.com/docs/twitter-libraries 获取 Twitter 库,获取流也应该非常简单。

    【讨论】:

      猜你喜欢
      • 2011-10-14
      • 1970-01-01
      • 1970-01-01
      • 2020-06-17
      • 2013-10-27
      • 1970-01-01
      • 2013-08-12
      • 2021-12-30
      • 1970-01-01
      相关资源
      最近更新 更多