【问题标题】:tf.data.experimental.make_csv_dataset: ValueError: `label_name` provided must be one of the columnstf.data.experimental.make_csv_dataset:ValueError:提供的`label_name`必须是列之一
【发布时间】:2021-04-28 10:02:52
【问题描述】:

我正在尝试构建一个数据集以在 Keras 中用于 Kaggle 上的泰坦尼克号示例。 这是我到目前为止所做的:

train_data = pd.read_csv("/kaggle/input/titanic/train.csv")

all_columns = ['PassengerId', 'Survived', 'Pclass', 'Name', 'Sex', 'Age', 'SibSp', 'Parch', 'Ticket', 'Fare', 'Cabin', 'Embarked'] # all the columns names present in the csv

feature_columns = ['Pclass', 'Sex', 'Age', 'SibSp', 'Parch', 'Ticket', 'Fare', 'Cabin', 'Embarked'] # columns that I want to use as features for the training part


train_data = tf.data.experimental.make_csv_dataset(
    "/kaggle/input/titanic/train.csv",
    batch_size=12,
    column_names=all_columns,
    select_columns=feature_columns,
    label_name='Survived', # name of the 'label' column
    na_value="?",
    num_epochs=1,
    ignore_errors=False)

但是在编译的时候,我得到了这个错误:

495   if label_name is not None and label_name not in column_names:
496     raise ValueError("`label_name` provided must be one of the columns.")
497 
498   def filename_to_dataset(filename):

ValueError: label_name 提供的必须是列之一。

但是,如您所见,label_name 值是“Survived”并且它存在于 all_columns 中(也存在于 column_names

有什么想法吗?

最好的

艾美式

【问题讨论】:

    标签: python tensorflow keras kaggle


    【解决方案1】:

    label_name 必须包含在select_columns

    试试:

    train_data = tf.data.experimental.make_csv_dataset(
        "/kaggle/input/titanic/train.csv",
        batch_size=12,
        column_names=all_columns,
        select_columns=feature_columns + ['Survived'],
        label_name='Survived', # name of the 'label' column
        na_value="?",
        num_epochs=1,
        ignore_errors=False)
    

    【讨论】:

      猜你喜欢
      • 2020-09-03
      • 2016-06-26
      • 2021-04-11
      • 2020-11-26
      • 1970-01-01
      • 2018-12-04
      • 1970-01-01
      • 1970-01-01
      • 2021-02-09
      相关资源
      最近更新 更多