【问题标题】:Is there a page limit for predicting using GCP AutoML for Custom Entity Extraction使用 GCP AutoML 进行自定义实体提取的预测是否存在页面限制
【发布时间】:2020-06-12 04:42:07
【问题描述】:

我正在尝试使用 GCP AutoML 探索自定义实体提取,我有一个用于训练模型的 10 页文档,其中我的实体也接受了 7 和 8 页的训练。

在从 GCP AutoML UI 进行测试时,我只使用了一个经过训练的文档,它无法提取前 5 页以外的实体。 - 这是目前允许的默认页数限制吗? - 或者它是可配置的,可以改变,如果是的话怎么做 - 或者我们可以请求 GCP 支持部门考虑完整的文档长度吗?

任何指针表示赞赏。

【问题讨论】:

    标签: google-cloud-platform entity document extraction automl


    【解决方案1】:

    limits of entity extraction 不允许超过 10000 个字符的文档,据我所知,这是无法修改的。 Natural Language Processing API 实体提取功能旨在分析短文档中的实体,因此如果您需要处理较长的文档,我建议您将它们分成小批量。

    希望对你有帮助。

    【讨论】:

    • 谢谢,但我尝试了最多 5 页的文档有大约 18k 个字符,它根据我所看到的文档的页数进行限制.. 找不到在基于 pdf 文档页面的 Cloud AutoML API 限制配额。
    • 这是否也与其他文档一起复制?
    猜你喜欢
    • 2021-06-03
    • 2021-06-09
    • 2019-10-06
    • 1970-01-01
    • 1970-01-01
    • 2020-06-16
    • 2020-10-09
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多