【发布时间】:2019-12-16 06:19:36
【问题描述】:
我很难将我的数据划分到用于特征工程的箱中。数据是我想按分类数据(邻域)分组的销售价格。
我做错了什么 - 我得到了所有行的 NaN 值?谢谢!
pricy_location = train['SalePrice'].groupby(train['Neighborhood']).mean()
label = ['rank1', 'rank2', 'rank3', 'rank4', 'rank5']
train['Pricy_Loc'] = pd.qcut(pricy_location, 5, labels=label, precision=2)
train['Pricy_Loc'].head()
【问题讨论】:
-
能否与我们分享您的数据样本?
-
你能分享你的示例输入吗?
-
数据和更多关于它的信息在这里,抱歉没有添加它:) kaggle.com/c/house-prices-advanced-regression-techniques/data
标签: python database pandas dataframe binning