【发布时间】:2016-03-11 04:43:07
【问题描述】:
我想从 Python 中从 .rda 文件加载的 rdaData 数据框中对 COL_TWO 进行子集化,其中 COL_ONE 是“A”。
rda数据:
COL_ONE COL_TWO
A 12
B 10
A 80
代码:
import rpy2.robjects import r
r.load(path/to/files.rda)
substr_data = r.subset(r('rdaData'), COL_ONE == 'A', select = 'COL_TWO')
在运行COL_ONE == 'A' 时,我收到以下错误消息:
COL_ONE not defined.
我知道COL_ONE 被视为 Python 变量而不是 R。所以我尝试了:
substr_data = r.subset(r('rdaData'), 'COL_ONE' == 'A', select = 'COL_TWO')
和
substr_data = r.subset(r('rdaData'), r('rdaData$COL_ONE')== 'A', select = 'COL_TWO')
COL_TWO 均未返回任何数据。我尝试了 r 中的代码,它返回 12 和 80。
我哪里做错了?
【问题讨论】:
标签: r python-3.x rpy2