【问题标题】:pandas.to_csv outputs a column of floats instead of integerspandas.to_csv 输出一列浮点数而不是整数
【发布时间】:2016-01-23 15:00:38
【问题描述】:

我正在从事一个项目,该项目涉及从数据框中查询数据,对其执行一些操作,然后将其存储在 csv 中。这是精简的代码。

get_value() 是一个函数,它返回从查询中获得的五个值的平均值,强制转换为 int。

import pandas as pd
d = pd.DataFrame(columns=['"Column1"','"Column2"'])
test = pd.read_csv("./test.csv", header = None, low_memory=False)
for line in range(1, 15):
    if test.values[line][5] == '1':
        value = str(get_value(line, 1))
    else:
        value = str(get_value(line, 0))
    d.loc[line-1]=[line,value]
d.to_csv('output.csv', index = False)

不幸的是,每当我这样做时,我都会将第一列(行,这里显然是一个整数)作为一系列浮点数。示例输出:

1.0,4859
2.0,7882
3.0,10248
4.0,8098
5.0,8048
6.0,6087
7.0,7349
8.0,8246
9.0,5863
10.0,5962
11.0,7641
12.0,8127
13.0,7808
14.0,9886

用 print 语句替换 to_csv 会给我一个充满漂亮整数的数据框:

0      1    4859
1      2    7882
2      3   10248
3      4    8098
4      5    8048
5      6    6087
6      7    7349
7      8    8246
8      9    5863
9     10    5962
10    11    7641
11    12    8127
12    13    7808
13    14    9886

因此,我怀疑它与 to_csv 有关,但我是新手,对此还不确定。这是怎么回事,有什么解决方法吗?感谢阅读。

编辑:DSM 很有帮助地建议我运行 d.info()。看起来他是对的,而且他们是 int-looking floats。

Int64Index: 14 entries, 0 to 13
Data columns (total 2 columns):
"Id"       14 non-null float64
"Sales"    14 non-null object

【问题讨论】:

  • 首先,您需要证明它们整数,而不仅仅是看起来像整数的浮点数。 :-) 请编辑您的问题以包含d.info() 的结果。
  • 完成——看起来你是对的。浮点数怎么看起来像整数?

标签: python pandas floating-point integer


【解决方案1】:

您可以通过 'astype' 方法将 'floats' 更改为 'int':

df['id'] =df['id'].astype(int)

【讨论】:

  • 工作就像一个魅力。谢谢,JAB。
  • 不幸的是,当列有空白时,这不起作用。
猜你喜欢
  • 1970-01-01
  • 2014-06-19
  • 2022-01-06
  • 1970-01-01
  • 2019-10-17
  • 2012-11-01
  • 2013-07-27
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多