【发布时间】:2019-01-17 11:19:24
【问题描述】:
我有一个包含 300 多列的庞大数据集,由于 90% 的列本质上是分类的,因此我决定对它们进行一次热编码,从而产生一个形状为 (466557、1778) 的数据集。我正在尝试使用以下方法扩展此数据:
from sklearn import preprocessing as p
scaler = p.StandardScaler()
df_ss = scaler.fit_transform(df)
但是,我遇到了内存错误。
MemoryError Traceback (most recent call last)
<ipython-input-92-d766bc7d2870> in <module>()
如何防止这种情况发生?
【问题讨论】:
标签: python-3.x scikit-learn jupyter-notebook