【发布时间】:2020-05-24 21:52:06
【问题描述】:
我有一个大约 10 列的数据框。所有都是数字类型并指示不同的地理区域。有些是相对值,如一定程度的居民百分比,有些是总值,如总人口。它或多或少是这样的:
median_age bachelor_rate emp_rate
1 35.2 0.05223252 0.6185185
2 22.5 0.40045249 0.7744094
3 36.3 0.26750261 0.8210526
4 36.8 0.07753825 0.5801861
5 29.9 0.04805492 0.3593074
6 26.8 0.00000000 0.4762367
>
我想做的是为每一列计算一个“索引”。我想我会取每列的平均值,然后计算每个单元格值的平均值之差。
例如median_age-column的第一个单元格:
mean_age = mean(df$mean_age)
median_age_1 = df$median_age[1]
index = median_age_1/mean_age
除了所有数学和索引相关的问题。我如何编写一个对所有列和所有单元格执行此操作的函数?
【问题讨论】:
标签: python r dataframe indexing statistics