【发布时间】:2022-03-01 22:13:48
【问题描述】:
我有包含特征列(字符串)和多个标签列(多标签分类)的 CSV 文件。数据集太大而无法放入内存,因此我必须使用 make_csv_dataset 以指定的批量大小加载它。问题是我不知道如何在不超载内存的情况下标记特征列,我可以实现一个 DataProvider 来在训练时动态标记数据吗?然后我可以批量标记它,所以内存不是问题。
【问题讨论】:
-
this 可能会有所帮助。
-
嗨 pbartkow,您能否具体说明 make_csv_dataset 中面临的问题
标签: python tensorflow machine-learning nlp