【发布时间】:2019-06-05 18:05:50
【问题描述】:
我有一个 Excel 文件要与 pandas 一起导入,其列存储为文本。需要注意的是,此文本是法语/拉丁语约定下的小数(基数)和千位数字,因此通过让 pandas 推断其类型,它会带来一个文本列,就像它在原始文件中呈现的那样:
NUMBER
0 23.639.826,11
1 92.275,00
2 1.917.000,00
8 2.409,02
9 13.501,00
Name: NUMBER, dtype: object
如何让 pandas 将此文本转换为正确的浮点格式,而无需对 Excel 文件本身进行转换或应用字符串方法来替换逗号和点?
NUMBER
0 23639826.11
1 92275.00
2 1917000.00
8 2409.02
9 13501.00
按照docs 的建议,我尝试在使用pd.read_excel 读取文件时使用thousands='.' 参数无济于事,并且使用pd.to_numeric 输出ValueError,因为它无法解析字符串。
【问题讨论】:
-
用替换检查
标签: python pandas number-formatting