【问题标题】:Why can't Form Recognizer SDK v3 find any OCR documents to train?为什么 Form Recognizer SDK v3 找不到任何要训练的 OCR 文档?
【发布时间】:2021-11-12 10:30:33
【问题描述】:

我正在尝试使用 v3 preview 构建表单识别器自定义模型,使用示例代码:

Uri trainingFileUri = new Uri(sasToken);
var client = new DocumentModelAdministrationClient(
               new Uri(endpoint), new 
               AzureKeyCredential(apiKey));

BuildModelOperation operation = await client.StartBuildModelAsync(trainingFileUri);

Response<DocumentModel> operationResponse = await operation.WaitForCompletionAsync();

sas 令牌用于包含 20 个 pdf 文件的 Blob 容器。当我运行时出现错误

状态:200(正常) 错误代码:无效请求

附加信息: AdditionInformation: InvalidRequest: 无效请求。

详情: ModelBuildError:无法构建模型:找不到任何用于训练的 OCR 文件。

原始:

{ "code": "无效请求", "message": "无效请求。", “细节”: [ { "code": "ModelBuildError", “消息”:“无法构建模型:找不到任何 OCR 文件进行训练。” } ] }

SAS 令牌有读、写、列出等权限,所以我不知道为什么客户端找不到任何要训练的文档。有什么想法吗?

【问题讨论】:

    标签: .net sdk ocr form-recognizer azure-form-recognizer


    【解决方案1】:

    您链接到的预览 API 不支持没有标签的训练。您将需要一个带标签的数据集来训练模型。

    您是否使用Form Recognizer Studio 标记您的文件?

    训练模型需要您的存储帐户包含 3 种类型的文件:

    1. 单个文件 - fields.json
    2. 对于训练数据集中的每个文件,在标记过程中会创建 2 个附加文件
      • {文件名}.labels.json
      • {文件名}.ocr.json

    错误消息表明您可能没有标记您的文档。

    【讨论】:

    • 谢谢,我已经标记了数据集,但是使用 v2 因此失败了。谢谢!
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2011-05-03
    • 2014-05-06
    • 1970-01-01
    • 2012-11-05
    • 2023-03-10
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多