【发布时间】:2021-12-20 01:39:06
【问题描述】:
我对 R 很陌生,所以也许这看起来很简单,但我想不通。我的数据看起来像 Df,它需要看起来像 Df2:
Df <- data.frame(country = c("A", "A", "A", "A", "A", "B","B", "B", "B"),
year = c("1950", "1951", "1952", "1953", "1954", "1950", "1951", "1952", "1953"),
start_year = c("NA", "1951", "1951", "NA", "1954", "1950", "NA", "1951", "1951"),
end_year= c("NA", "NA", "1952", "NA", "1954", "1950", "NA", "NA", "NA"),
status = c(0, 1, 1, 0, 1, 1, 0, 1, 1),
treatment = c(10, "NA", 20, 5, "NA", "NA", 30, 100, 10))
Df2 <- data.frame(country = c("A", "A", "A", "A", "B","B", "B"),
time1 = c("1950", "1951", "1953", "1954", "1950", "1951", "1952"),
time2 = c("1951", "1953", "1954", "1955", "1951", "1952", "1954"),
status = c(0, 1, 0, 1, 1, 0, 1),
treatment = c(10, 20, 0, "NA", "NA", 30, 110))
我们的目标是在一个结构中进行 PWP 循环事件分析。 Df2 中的处理应该是间隔时间 1 到时间 2 的处理值之和。
有什么想法可以到达那里吗?谢谢!
【问题讨论】:
-
为什么 B 带有
time1 = 1952和treatment = 110但A hastime1 = 1951` 和treatment = 20。这里选择year或start_year的逻辑是什么? -
@Martin Gal
Treatment在我的数据中是对妇女组织的资助金额。而year是观察年份,也就是资金发放的年份。start_year显示冲突何时开始。现在有意义吗?
标签: r survival-analysis