【问题标题】:R read .txt document having encoding ‘ANSI’(windows base) having correct Swedish characterR读取具有正确瑞典字符编码'ANSI'(windows base)的.txt文档
【发布时间】:2020-03-24 19:24:42
【问题描述】:

我正在使用基于 Windows 的机器。我有一个 test.txt 文档,它的编码为“ANSI”,里面有瑞典字符。我希望我可以将这些信息读给 R 进行进一步分析。 有什么建议吗?

我目前的解决方案是我需要将 .txt 文档另存为具有“utf_8”编码的新文档,然后使用下面的代码。但是希望有一个建议可以直接读取正确格式的“ANSI”。谢谢!

文档看起来像:

文件格式:

如果我将 .txt 重新保存为 'utf-8' 格式,代码就可以工作

dftxt <- readr::read_delim('./data/text_Briljant2.txt', 
                       delim = '\t', skip = 15,
                       locale = locale('se', encoding = 'UTF-8'),
                       col_names = F) %>% select(-c(X5, X6))

似乎提供可重复的样本是不可行的。但如果你让我知道我可以在哪里上传我愿意提供的文件。

感谢您的任何建议。

【问题讨论】:

    标签: r encoding readr


    【解决方案1】:
    dftxt <- readr::read_delim('test.txt', 
                               delim = '\t', skip = 15,
                               locale = locale('se', encoding = 'ISO8859-1'),
                               col_names = F) %>%
      select(-c(X5, X6))
    

    【讨论】:

      猜你喜欢
      • 2012-11-30
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2011-11-11
      • 2018-05-22
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多