【发布时间】:2018-02-22 21:24:24
【问题描述】:
我有一个文件,其中包含记录事件时间的列。有时时间采用 mm:ss 格式,有时末尾有额外的零 - mm:ss:00。请参见下面的示例:
id time
1 20:50
2 76:58:00
3 56:13:00
4 03:44
当我使用 read_csv 读取此数据时,所有较短格式 (mm:ss) 的值都标记为 NA。当我使用read_csv('data.csv', col_types = cols(time = col_character())) 将此值设置为作为字符串读取时,所有值都更改为更短的格式(所以我在第二行中有76:58)。如何解析此 time 列以将所有数据都采用一种格式(无论是较短还是较长),但作为 time 类型的变量并且不会丢失这些较短格式的输入的数据?
为什么在解析为时间时将所有 8 个字符的值都替换为“NA”?
【问题讨论】:
-
我没有
read_csv使用您的示例数据的问题。这表明问题在于您的文件data.csv。