【发布时间】:2015-10-02 06:17:47
【问题描述】:
我有一个大型数据集(约 250,000 条记录),我使用 splitting 使数据更易于访问。我最终得到了 250 次拆分。
我想知道哪个拆分的列最多。我知道我应该使用list.files,但我不知道如何使它工作。
我创建了以下可重现的示例:
df1 <- data.frame(A = c("a"),B = (c("b")), C = (c("c")))
df2 <- data.frame(A = c("a"),B = (c("b")))
df3 <- data.frame(A = c("a"))
write.csv(df1, file = "df1.csv", row.names=FALSE)
write.csv(df2, file = "df2.csv", row.names=FALSE)
write.csv(df3, file = "df3.csv", row.names=FALSE)
filenames <- list.files(pattern="*.csv", full.names=TRUE)
看上面的例子,我想知道df1 与其他文件相比具有最多的属性。
for 循环和一个简单的ncol 函数可以使其工作吗?
【问题讨论】:
标签: r csv dataframe multiple-columns