【发布时间】:2021-09-16 15:34:38
【问题描述】:
我有一个要分析异常的数据集(见图 1)。
数据集的故事如下: 我测量了每个推理(图像分类任务)的温度(TPU、CPU)、内存(MemUsed)和时间(Time)。 我还对“时间”列进行了累计,以获得对 70000 张图像进行分类的整个过程所需的时间。这大约是 7000 秒。
以下代码是我在尝试获取时间戳(又名“_time”)时得到的。在图 2 中,您将看到它的外观。
#Return the index with frequency (RangeIndex to DateTimeIndex)
df1_MAX['_time']=pd.to_datetime(df1_MAX['TimeTotal'])#string to DatetimeIndex
df1_MAX=df1_MAX.set_index('_time')
df1_MAX
由于我在几秒钟内处理数据,我如何才能获得正确的时间戳?我需要使用什么格式?
谢谢
图片 1
图片 2
------------------编辑-------------- 使用 timedelta64
---------------编辑------------
我将“TimeTotal”更改为 ms。并将'timedelta64 []'放在毫秒中。
df1_MAX['_time']= pd.to_datetime("2020-07-06 10:53:00")+df1_MAX['TimeTotal'].astype('timedelta64[ms]')
df1_MAX=df1_MAX.set_index('_time')
df1_MAX
【问题讨论】:
-
你的意思是你测量了时间流逝?
-
我测量了每个推理的持续时间(时间)。是的,失误了。
-
“正确的时间戳”和“什么格式”是什么意思?你的意思是数据类型? - 请注意,这将取决于您要对数据执行的操作,即您要解决的问题。
标签: python-3.x pandas time-series timestamp