【发布时间】:2017-07-27 13:59:49
【问题描述】:
我有一个按时间顺序排列的数据集,我已使用以下方法将其导入 R:
mydata <- read.csv(file="test.csv",stringsAsFactors=FALSE)
数据集中的两列是“赢家”和“输家”。数据中的每一行都是一场网球比赛。
我想要做的是添加两列,这可以让我计算出“获胜者”列中的玩家已经玩过的总匹配数,包括该行的匹配数。并且该行中的“失败者”的计数相同。
例如,它看起来像这样:
winner loser winner_matches loser_matches
tom andy 1 1
andy greg 2 1
greg tom 2 2
我希望这是有道理的。
我已尝试使用以下代码,但无法使其在两列中都起作用:
ave(mydata$winner_name==mydata$winner_name, mydata$winner_name, FUN=cumsum)
所以下面的数据是前10行20000左右。
【问题讨论】:
-
你的预期输出是多少
-
所以目前winner_matches 和loser_matches 列不在我的数据中,它们是我想要通过累计计算两列中的名称来实现的目标
-
好的,你介意分享一下当前的
mydata是什么样的吗? -
@Masoud 您不应该根据答案添加标签。它们应该只与问题有关。我认为这里不需要dataframe,另外两个也不会出现在问题中。
-
@Frank 我对此略有不同意见。有元帖子谈论这个问题。当然标签不应该基于答案,但我认为这属于其中的例外。仍然是一个有争议的事情。我将在您的最新编辑中留下问题。干杯。
标签: r