【发布时间】:2021-11-22 05:29:17
【问题描述】:
我在 WEKA 中打开数据集时遇到问题。虽然在其 .csv 格式中,所有变量和各自的值都被清楚地区分,但在 WEKA 我只有一个属性,如下所示:
PINCP;艾格普;朗讯; RACWHT; RACBLK;拉卡斯;性别;等等
相关的值看起来很相似,也用分号分隔。
您对如何完成这项工作有任何建议吗?
提前致谢!
【问题讨论】:
标签: csv data-mining weka converters arff
我在 WEKA 中打开数据集时遇到问题。虽然在其 .csv 格式中,所有变量和各自的值都被清楚地区分,但在 WEKA 我只有一个属性,如下所示:
PINCP;艾格普;朗讯; RACWHT; RACBLK;拉卡斯;性别;等等
相关的值看起来很相似,也用分号分隔。
您对如何完成这项工作有任何建议吗?
提前致谢!
【问题讨论】:
标签: csv data-mining weka converters arff
CSV 代表comma-separated values。另一方面,您的数据集使用分号作为单元格之间的分隔符。
在 Weka Explorer 中打开您的数据集时,请选中文件选择器对话框中的 调用选项对话框 框。然后将 fieldSeparator 选项从逗号更改为分号。
如果您使用命令行加载数据集,请使用 CSVLoader 类的 -F 选项。
【讨论】: