【问题标题】:Scrape Twitter data with R [closed]用 R 抓取 Twitter 数据 [关闭]
【发布时间】:2023-04-03 16:34:02
【问题描述】:

我正在尝试找到一种使用主题标签来抓取 Tweeter 数据的简单方法。例如,我希望能够抓取所有包含#testhash 的推文。

我看过一些帖子,尤其是一个 (http://www.datablog.sytpp.net/2014/04/scraping-twitter-with-r-a-how-to/),但 tweetR 包似乎已损坏(未安装在我的计算机上并导致 R 崩溃)。 任何想法都会很棒,但我特别熟悉 R,所以会更好。

【问题讨论】:

    标签: r twitter scrape tweetr


    【解决方案1】:

    2015 年 4 月,the blog post you mentioned 中的代码不再适用于我(使用 twitteR v1.1.8)。

    我不知道你为什么没有成功安装 twitteR 包。尝试自己一个一个地安装依赖项。 对于每个:

    方法、bit64、rjson、DBI、httr、twitteR

    运行

    install.packages("methods")
    #...
    

    也许这有助于找出问题所在。

    然后我只是尝试了这个(快速而肮脏的解决方案。不要与任何人分享您的明文凭据):

    library(twitteR)
    
    #, please see https://apps.twitter.com/
    consumerKey = "PH...."   # from your app name
    consumerSecret = "zr...."
    accessToken = "5199999-22...."
    accessSecret = "94..."
    options(httr_oauth_cache=TRUE) # skip question appearing on console
    setup_twitter_oauth(consumer_key = consumerKey, consumer_secret = consumerSecret,
                        access_token = accessToken, access_secret = accessSecret)
    
    # tweets about beer
    searchTwitter("#beer", n=100)
    # tweets about Berlin
    searchTwitter("#berlin", n=100)
    # tweets about nerds
    searchTwitter("#nerds", n=100)
    # tweets about R
    #Rtweets(n=42)
    # ...
    ##########################################################################
    ## lets test out what our session limits look like now after these requests
    ##########################################################################
    rate.limit <- getCurRateLimitInfo()
    # print out all metrics that have been changed
    rate.limit[rate.limit$limit != rate.limit$remaining,]
    

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2015-12-26
      • 1970-01-01
      • 1970-01-01
      • 2015-08-19
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多