【发布时间】:2018-12-21 19:37:00
【问题描述】:
我想减少我的Pandas dataframe 的内存输出。
我正在解析一个 Json,其中一些列是多值类别列表,例如:
querySelectedBrands":["b1","b2","b3"]
这会自动推断为“对象”列,但理想情况下是类别列表。 每当我有一个单值分类列时,进行转换非常简单:
interactions[col] = interactions[col].astype('category')
但是我想将类型设置为类别列表的列呢? 稍后我将对该列进行编码,将其转换为一系列布尔列,因此我不确定在“类别”列表中转换的初始内存优势是否会有益。 谢谢!
【问题讨论】:
标签: python pandas sklearn-pandas pandas-datareader