【发布时间】:2018-06-19 21:44:50
【问题描述】:
我正在尝试编写一个 python 脚本来导入由数据采集软件 (EC-lab) 生成的数据文件。我想将列标题保留在文件中,而不是手动定义它们,因为它们在所有文件中并不统一(不同的技术将以不同的顺序生成数据,并且标题数量不同)。问题是文件中的标题文本包含正斜杠(例如“ox/red”、“time/s”)。
当我尝试使用标题列加载数据时出现 ascii 错误
UnicodeDecodeError:“ascii”编解码器无法解码位置 19 中的字节 0xb5:序数不在范围内 (128)
我尝试根据其他解决方案添加编码作为关键字参数,但没有产生解决方案
data = np.genfromtxt("20180611_bB_GCE-G.mpt", dtype=None, delimiter='\t', names=True, skip_header=61, encoding='utf-8')
我目前使用 genfromtxt 作为数据导入技术
data = np.genfromtxt("filename.mpt", dtype=None, delimiter='\t', names=True, skip_header=61)
【问题讨论】:
-
该错误似乎与正斜杠无关。
-
添加
encoding='utf-8'真的不会改变错误信息,还是意味着你得到一个不同的UnicodeDecodeError? -
标题名称用于创建结构化数组字段名称(甚至
recarray属性)。因此它们的处理方式与字符串数据(encoding现在处理)不同。一些参数与名称有关。关于有趣的标题名称有很多问题。
标签: python numpy genfromtxt