【发布时间】:2021-08-09 04:36:07
【问题描述】:
我有一个巨大的文件 (csv2),我使用命令 sqldf() 从中选择 1000 个观察值。具体来说,我使用以下代码:
f<-file("C:/Users/myfile.csv")
df<-sqldf("SELECT DISTINCT Draw
FROM f
ORDER BY RANDOM(*)
LIMIT 1000",
file.format = list(header = TRUE, sep=";", dec=","))
df<-sqldf("SELECT * FROM f
WHERE Draw IN df",
file.format = list(header = TRUE, sep=";", dec=","))
问题在于 R 似乎无法识别连接中的文件是 csv2 并且生成的数据框中的数据被分类为文本,因为小数点的逗号未转换为点。你知道有没有办法解决这个问题? 谢谢!
【问题讨论】:
-
根据 r 标签页面顶部的要求,请提供可重现的示例。特别是,除了您之外没有人可以运行它,因为该问题没有示例文件可供尝试。前几行就足够了。