【发布时间】:2012-04-11 01:36:42
【问题描述】:
我每 30 分钟将一个 Y 国的 Twitter 热门话题存储在一个数据库中。这没问题。 现在,我希望获得尽可能多的与这些热门话题相匹配的推文以用于研究目的。
因为我想研究趋势的模式,所以我想要以检测到趋势峰值之日为中心的至少 3 天的连续推文数据,用于每个趋势主题。为了实现这一点,我想到了做以下事情:
假设我在第 X 天。我可以检索第 X-2 天的独特趋势,并且对于每个趋势,在区间 [X-3, X-1] 内寻找与趋势匹配的推文,即 3 天.但是,这里的问题是 Twitter 速率限制。如果我在第 X-2 天有 100 个热门话题,并且我发出 20 个 GET 搜索请求/趋势,我最终会发出总共 2,000 个请求,这超过了 Twitter 每小时 350 个速率的限制。如果make 300 req/hour,那么仅仅一天的数据就需要6个多小时......
有没有人知道任何其他(更好的)方法来获取与趋势相关的推文?
提前致谢
【问题讨论】: