【发布时间】:2021-08-12 13:01:13
【问题描述】:
我正在与 R 合作。
在这里我分享我的数据样本...
structure(list(column_a = c("1_1", "1_1", "1_2", "1_2", "1_2",
"2_1", "2_2", "2_2", "3_1", "3_2"), column_b = c("kitchen", "tree",
"hate", "kind", "table", "dog", "human", "car", "moon", "rage"
)), row.names = c(NA, -10L), class = c("tbl_df", "tbl", "data.frame"
))
column_a column_b
1 1_1 kitchen
2 1_1 tree
3 1_2 hate
4 1_2 kind
5 1_2 table
6 2_1 dog
7 2_2 human
8 2_2 car
9 3_1 moon
10 3_2 rage
我需要计算条件(1_1、1_2 等)产生的总单词的平均值。我遇到的唯一问题是以“_1”结尾的条件总数为 50,而以“_2”结尾的条件总数为 100。
因此,由于条件“1_1”产生了两个单词(在示例中),我应该通过 50 的潜水来计算平均值。这是 2/50 = 0.04。但是,在计算“1_2”条件的平均值时,我需要除以 100。这是 3/100 = 0.03。
考虑到某些条件需要按 50 计算,而其他条件需要按 100 计算,我需要创建一个列,该列具有条件产生的总单词的平均值。我怎样才能做到这一点并且仍然有结果在同一列?
【问题讨论】: