【发布时间】:2018-03-12 04:58:48
【问题描述】:
我检索了具有不同跟踪期的各种主题标签的 Twitter 推文。例如,hashtag1 跟踪 6 天,hashtag2 跟踪 4 天,hashtag3 跟踪 2 天。如何标准化每个主题标签?我怎样才能将它们分成相等的四分之一?提前谢谢...这是代码......>
library(streamR)
library(rjson)
setwd("/Users/Desktop")
Tweets = parseTweets("Hashtag1.json")
table(Tweets$created_at)
dated_Tweets <- as.POSIXct(Tweets$created_at, format = "%a %b %d %H:%M:%S
+0000 %Y")
hist(dated_Tweets, breaks="hours", freq=TRUE, xlab="dated_Tweets", main=
"Distribution of tweets", col="blue")
【问题讨论】:
-
你能告诉我们你现在得到了什么,并解释你到底对什么不满意吗?你想为每个主题标签提供类似每天的推文吗?
-
是的,我可视化了每个主题标签的直方图,但是每个主题标签都有不同的跟踪周期,所以我想规范化每个主题标签。例如,我想将 24 小时的每一天分成 4 个季度(每 6 小时),然后在同一个直方图上累积所有天。
-
所以你有推文时间戳。您想为每条推文创建“日区”直方图吗?你想看看 #2 是否在推特上发得更多,比如早上的时候,而 #4 是在晚上?
-
@OttToomet 没错!
标签: r twitter histogram normalization tweets