【问题标题】:Decoding character strings vectors in R在 R 中解码字符串向量
【发布时间】:2021-02-10 04:38:54
【问题描述】:

假设您有一个包含编码字符串的原子向量:

string_encoding <- c("São Paulo", "Paraná")

有什么方法可以解码向量中的每个元素,返回一个长度相同的 ASCII、ISO-8859-1 或其他编码类的向量?

输出应该是:

expected_encoding <- c("Sao Paulo", "Parana")

【问题讨论】:

    标签: r string encoding utf-8 ascii


    【解决方案1】:

    另一个选项可以是:

    iconv(string_encoding, to='ASCII//TRANSLIT')
    

    输出:

    [1] "Sao Paulo" "Parana"
    

    【讨论】:

      【解决方案2】:

      使用stringi,您可以:

      stri_trans_general(string_encoding, "Latin-ASCII")
      
      [1] "Sao Paulo" "Parana"
      

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 1970-01-01
        • 2013-09-09
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 2018-12-08
        相关资源
        最近更新 更多