【发布时间】:2021-04-10 03:54:14
【问题描述】:
我有一个数据集,其中包含来自 Twitter 的大量推文 ID 和用户 ID。在 R 中加载数据框时,它会投影数字,例如像这样“1.236967e+18”。由于它不是数字而是 ID,因此我需要完整的数字才能从 ID 下载推文文本。我试过这个:
daytwo <- read.table(file = 'ids_2020-03-09.csv', sep = ';', header = TRUE, as.is = !stringsAsFactors)
但是我得到它找不到stringAsFactors的错误。我认为这个论点是预测完整数字的关键
Error in read.table(file = "ids_2020-03-09.csv", sep = ";", header = TRUE, :
Object 'stringsAsFactors' not found
如果我不添加 stringsAsFactors 参数,它会使用 +18 投影导入数据。如何一次为整个数据集更改它?我已经尝试在 Excel 中进行更改,但 R 总是在导入时将其更改回来。谢谢!
【问题讨论】:
-
我猜这只是一个打印问题 - 查看stackoverflow.com/q/5352099/7941188
-
我不确定这只是打印/显示选项的问题。 Nicole,你能检查一下 ID 列的数据类型吗?它们是以双精度还是整数形式加载的?
-
read.table 有 "colClasses" 参数,将 ID 列读取为字符。
标签: r dataframe twitter read.table