【发布时间】:2021-05-15 06:08:38
【问题描述】:
我有一个包含非结构化数据的 excel 文件。 1 列包含 4 条数据的文本,我正在将其导入数据框...某些数据可能与该列的预期不匹配
03/04/21 08:08:26 -> - 50.20
03/04/21 11:08:26 -> + 283.75
03/04/21 10:48:34 -> Scale Timeout
我可以.split(' ', expand=True) 这个来获得 12 列。
0 1 2 3 4 5 6 7 8 9 10 11
0 03/04/21 08:08:26 -> - 50.20
1 03/04/21 08:28:26 -> - 50.20
当我复制 cols[0,4,8,11]、重命名它们并复制到新的 df 时,这就像一个典型的数据框:
date time sign mass
0 03/04/21 08:08:26 - 50.20
1 03/04/21 08:28:26 - 50.20
2 03/04/21 08:48:26 - 50.15
现在事情向南......我什至不能print(df['date'])
我得到错误: 只有整数标量数组可以转换为标量索引
我检查了 dtype,所有 cols 都是类型对象。我试过 .astype(str),但仍然得到同样的错误
#困惑
一定是 .split() 创建了我没有正确寻址的 dtype?
【问题讨论】: