【发布时间】:2017-01-26 01:45:58
【问题描述】:
我已经用X = X.fillna(X.mean()) 填写了NaN 的。但我仍然收到错误
"ValueError: 发现样本数不一致的数组:[ 7 210]"
当我尝试我的 train_test_split 时。
我查看了我的 X df,似乎仍然缺少值(空格)。
例如,如何用该列的平均值填充这些空白?
【问题讨论】:
我已经用X = X.fillna(X.mean()) 填写了NaN 的。但我仍然收到错误
"ValueError: 发现样本数不一致的数组:[ 7 210]"
当我尝试我的 train_test_split 时。
我查看了我的 X df,似乎仍然缺少值(空格)。
例如,如何用该列的平均值填充这些空白?
【问题讨论】:
你可以试试这个例子:
df = pd.DataFrame({'A': [1,2,3,4,5], 'B': [6,7,8,np.nan,10]})
A B
0 1 6.0
1 2 7.0
2 3 8.0
3 4 NaN
4 5 10.0
print(df.B.fillna(df['B'].mean()))
0 6.00
1 7.00
2 8.00
3 7.75
4 10.00
Name: B, dtype: float64
【讨论】: