【发布时间】:2014-10-01 04:35:20
【问题描述】:
正确的问题。
我有一个 data.frame(结构如下),主要是分类变量(大多数二进制,即是或否,一个具有三个级别(data.frame$tertile)。
'data.frame'::
$ smoker : Factor w/ 2 levels "Yes","No"
$ mi : Factor w/ 2 levels "Yes","No":
$ angina : Factor w/ 2 levels "Yes","No":
$ pvd : Factor w/ 2 levels "Yes","No":
$ isch.stroke : Factor w/ 2 levels "Yes","No":
$ ht.1 : Factor w/ 2 levels "Yes","No":
$ tertile : Factor w/ 3 levels "1","2","3":
我想生成一个数据框,其中包含所有分类变量的汇总统计数据,即按 data.frame$tertile 分组的患者比例。
是否可以将 ddply 用于分类变量,我已设法将 ddply 用于连续变量
x <- ddply(data.frame,.(tertile), numcolwise(mean,))
但发现很难同时应用 catcolwise 函数和使用 ddply。
在此先感谢各位,并感谢任何回复。
问候
阿努普
【问题讨论】:
-
如果您能提供代码来重现您的数据框,将会很有帮助。
-
您似乎主要或只有因子变量。您认为“是”和“否”的含义是什么?