【发布时间】:2020-12-25 17:00:23
【问题描述】:
我得到了这个时间格式
2020 年 8 月 28 日星期五 11:34:57,915
来自 tera 术语数据记录。我正在尝试找到一种将其转换为更方便的时间格式的可能性。到目前为止,我找不到合适的包(例如chron、lubridate 和POSIXct)或类似的东西。但到目前为止,我从来没有通过转换时间格式遇到过这样的问题,所以我希望其他人已经知道一些事情。
否则我必须以某种方式手动重新安排它。
【问题讨论】:
我得到了这个时间格式
2020 年 8 月 28 日星期五 11:34:57,915
来自 tera 术语数据记录。我正在尝试找到一种将其转换为更方便的时间格式的可能性。到目前为止,我找不到合适的包(例如chron、lubridate 和POSIXct)或类似的东西。但到目前为止,我从来没有通过转换时间格式遇到过这样的问题,所以我希望其他人已经知道一些事情。
否则我必须以某种方式手动重新安排它。
【问题讨论】:
你可以试试:
strptime("Fri Aug 28 11:34:57,915 2020", format = "%a %b %d %H:%M:%S")
#> [1] "2020-08-28 11:34:57 BST"
或者,如果您想确保正确捕获年份,您首先需要去掉尾随毫秒的逗号:
f <- function(x) strptime(gsub(",\\d+", "", x), format = "%a %b %d %H:%M:%S %Y")
f(c("Fri Aug 28 11:34:57,915 2020", "Mon Feb 05 12:21:05,321 2018"))
#> [1] "2020-08-28 11:34:57 BST" "2018-02-05 12:21:05 GMT"
【讨论】:
%OS。 (和sub(",", ".", x))。
Sys.setlocale("LC_TIME", "en_US.UTF-8"),一切正常。
strptime 中的捕获依赖于语言环境,因此如果您的语言环境设置为与您正在解析的格式具有不同名称的工作日和月份名称,则需要将语言环境更改为每@RuiBarradas
"%OS" 保留小数位。
如果格式始终相同,您可以尝试使用正则表达式提取必要的日期元素(这是访问末尾年份信息所必需的),然后转换为正确的日期格式:
test <- "Fri Aug 28 11:34:57,915 2020"
test2 <- gsub(x = test,
pattern = "([A-Za-z]+) ([A-Za-z]+) ([0-9]+) ([0-9]+):([0-9]+):([0-9]+),[0-9]+ ([0-9]+)",
replacement = "\\2 \\3 \\7 \\4:\\5:\\6")
date <- as.POSIXct(test2, format = "%b %d %Y %H:%M:%S")
date
【讨论】: