【问题标题】:Annotation specs - AutoML (GCP)注释规范 - AutoML (GCP)
【发布时间】:2021-04-14 01:57:23
【问题描述】:

我在 Google Cloud Platform 上使用自然语言模块,更具体地说是使用 AUTOML 进行文本分类。 当我完成导入数据并且文本已被处理时,我遇到了这个我不明白的错误:

错误:数据集有太多注释规范,最大允许数量为 5000。

这是什么意思?你已经拿到了吗?

谢谢

【问题讨论】:

标签: google-cloud-platform automl google-cloud-automl-nl


【解决方案1】:

查看AutoML Quotas & Limits 文档以获得更好的理解。

您似乎正在触及每个数据集标签的最高限制。检查AutoML limits --> 每个数据集的标签 --> 2 - 5000(用于分类)。

考虑到与配额不同,限制不能增加。

【讨论】:

    【解决方案2】:

    当我确定我的标签数量低于 5000 时,我也遇到了这个错误。结果证明我的 CSV 格式有错误。

    当您在 Pandas 中使用 to_csv() 创建文本数据时,它只会引用包含逗号的文本数据部分,而 AutoML Text 则希望您引用文本的所有行。我已经写了解决方案in this Stackoverflow answer

    【讨论】:

      猜你喜欢
      • 2020-12-02
      • 2012-09-28
      • 2016-09-30
      • 1970-01-01
      • 2014-04-08
      • 2017-04-06
      • 2013-08-01
      • 1970-01-01
      • 2021-07-09
      相关资源
      最近更新 更多