【问题标题】:dealing with different numeric formats within the same file in R [duplicate]在R中处理同一文件中的不同数字格式[重复]
【发布时间】:2020-08-11 08:28:03
【问题描述】:

我正在使用依赖于用户输入的文件。当然,这个输入是不一致的,我不确定处理这个问题的最佳方法是什么?我正在处理数字,我已将其作为字符读入:

mydata$output1
    [1] "PP150" NA "50,376.45\r\n" "40096.21" "43721.59" NA NA "27282272.16" NA  

"50,376.45\r\n" 实际上在预览中显示为一个简单的数字,我(以我有限的经验)从未见过类似的东西。我怎样才能从中创建一个数字向量?

我想得到:

[1] "PP150" NA "50376.45" "40096.21" "43721.59" NA NA "27282272.16" NA

【问题讨论】:

    标签: r data.table format base


    【解决方案1】:

    您可以使用gsub 删除您不想要的字符:

    x <- c("PP150",NA, "50,376.45\r\n","40096.21","43721.59",NA,NA,"27282272.16", NA)
    
    gsub('[,\r\n]', '', x)
    #[1] "PP150"   NA  "50376.45" "40096.21" "43721.59"  NA  NA   "27282272.16" NA
    

    最终输出仍然是一个字符串,因为“PP150”不是一个数字。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2019-04-04
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多