【发布时间】:2021-02-08 03:32:17
【问题描述】:
假设我有一个非常大的数据集,其中包含品酒的结果,品酒描述符存储在其中一个变量中。
data.frame(c("red","white","rose"),c("grapefruit, raspberry", "sweet, bold", "tannins, long finish"))
可能的描述符数量巨大。我想以一种可用于机器学习技术分析的方式解压它们。我应该将每个可能的描述符放在自己的变量中,还是有更有效和更紧凑的方式来存储此类数据?
提前谢谢你!
【问题讨论】:
标签: r dataframe bigdata data-manipulation data-wrangling