【问题标题】:Identify actual message language settings in R识别 R 中的实际消息语言设置
【发布时间】:2018-03-04 10:52:08
【问题描述】:

我试图识别 R 中的语言设置(显示消息等的语言)。

初始情况如下:

  • 我使用的是 Windows,所以Sys.getlocale(category="LC_MESSAGES") 不可用
  • 在 R 控制台(标准编辑器)中,所有消息都是德语;但是,Sys.getenv("LANGUAGE")=""
  • 在 R Studio 中,所有消息都是英文的; Sys.getenv("LANGUAGE")="",也一样。

我想要做的是:识别实际 R消息语言,即呈现给用户的消息语言(R控制台中的德语,RStudio中的英语),并且独立于使用的操作系统。 这意味着,理想情况下希望避免处理来自 Sys.getlocale() 的结果字符串(例如“de_DE.UTF-8”),这些字符串取决于操作系统。

有什么想法吗?非常感谢!

【问题讨论】:

  • 尝试Sys.setenv("LANGUAGE" = "EN"),然后再次尝试Sys.getenv("LANGUAGE")
  • @jaySf:问题是,我想找出当前语言是什么,而不是设置它。所以我得到Sys.getenv("LANGUAGE")="",这意味着RStudio中的“英语”和R控制台中的“德语”。我想知道是否有办法找出当前使用的实际消息语言。
  • 实际上你得到了"",每个Rstudio和R都在使用它的默认值,特别是一些where

标签: r


【解决方案1】:

我终于想出了一个解决办法。我生成错误并分析错误消息以识别语言。

为此,我首先使用以下函数检查错误消息的所有可能语言版本,该函数返回带有 ISO 国家代码(我从维基百科获取)的数据框和相应语言的错误消息:

createmessages <- function() {
  countries <- c("AF","EG","AX","AL","DZ","AS","VI","AD","AO","AI","AQ","AG","GQ","AR","AM","AW","AC","AZ","ET","AU","BS","BH","BD","BB","BY","BE","BZ","BJ","BM","BT","BO","BQ","BA","BW","BV","BR","VG","IO","BN","BG","BF","BU","BI","EA","CL","CN","CP","CK","CR","CI","CW","DK","DD","DE","DG","DM","DO","DJ","EC","SV","ER","EE","CE","EU","FK","FO","FJ","FI","FR","FX","GF","PF","TF","GA","GM","GE","GH","GI","GD","GR","GL","GP","GU","GT","GG","GN","GW","GY","HT","HM","HN","HK","IN","ID","IM","IQ","IR","IE","IS","IL","IT","JM","JP","YE","JE","JO","YU","KY","KH","CM","CA","IC","CV","KZ","QA","KE","KG","KI","CC","CO","KM","CD","CG","KP","KR","XK","HR","CU","KW","LA","LS","LV","LB","LR","LY","LI","LT","LU","MO","MG","MW","MY","MV","ML","MT","MA","MH","MQ","MR","MU","YT","MK","MX","FM","MD","MC","MN","ME","MS","MZ","MM","NA","NR","NP","NC","NZ","NT","NI","NL","AN","NE","NG","NU","MP","NF","NO","OM","AT","TL","PK","PS","PW","PA","PG","PY","PE","PH","PN","PL","PT","PR","RE","RW","RO","RU","SB","BL","MF","ZM","WS","SM","ST","SA","SE","CH","SN","RS","CS","SC","SL","ZW","SG","SX","SK","SI","SO","ES","LK","SH","KN","LC","PM","VC","ZA","SD","GS","SS","SR","SJ","SZ","SY","TJ","TW","TZ","TH","TG","TK","TO","TT","TA","TD","CZ","CS","TN","TR","TM","TC","TV","SU","UG","UA","HU","UM","UY","UZ","VU","VA","VE","AE","US","UK","VN","WF","CX","EH","ZR","CF","CY")
  e <- c()
  for(i in 1:length(countries))
  {
    Sys.setenv("LANGUAGE"=countries[i])
    res <- tryCatch( { xhajakjkula/1 }, error = function(err) { return(err) })
    e[i] <- res$message
  }
  Sys.setenv("LANGUAGE"="DE")
  return(data.frame(countries,e))
}

分析生成的数据框后,我发现只有六个 ISO 国家代码以不同于英语的语言(即波兰语、法语、西班牙语、德语、土耳其语和意大利语)产生错误消息。我使用错误信息创建了一个返回语言的函数(以英语为默认返回值:

getlanguage <- function() {
  res <- tryCatch( { xhajakjkula/1 }, error = function(err) { return(err) })
  lang <- "EN"
  if(res$message == "Objekt 'xhajakjkula' nicht gefunden") lang <- "DE"
  if(res$message == "objet 'xhajakjkula' introuvable") lang <- "FR"
  if(res$message == "oggetto \"xhajakjkula\" non trovato") lang <- "IT"
  if(res$message == "nie znaleziono obiektu 'xhajakjkula'") lang <- "PL"
  if(res$message == "objeto 'xhajakjkula' no encontrado") lang <- "ES"
  if(res$message == "'xhajakjkula' nesnesi bulunamadi") lang <- "TR"
  return(lang)
}

【讨论】:

  • 好方法!请注意:我已经在 Ubuntu 14.04 上使用 R3.4.4 测试了您的 createmessages 函数,但它始终使用 R 启动时设置的语言,并且在 R 运行时无法更改语言。
  • 对这种方法的轻微修改(感谢 Uwe Ligges)是使用如下内容:tryCatch( { "abc"/1 }, error = function(err) { return(err) })产生错误。当您开发 R 包时,此代码不会无法通过 CRAN 的自动检查,而我上面的原始方法(访问不存在的对象)会产生验证错误。
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2017-12-19
  • 1970-01-01
  • 2022-06-13
  • 1970-01-01
  • 1970-01-01
  • 2011-05-27
  • 2021-06-27
相关资源
最近更新 更多