【问题标题】:Training Computer Vision OCR训练计算机视觉 OCR
【发布时间】:2020-09-16 11:41:10
【问题描述】:

我设置了 Azure 计算机视觉服务并在我的应用程序中使用。当我尝试对某些图像执行 OCR 时,它无法识别所有文本(即在“cups”中省略“S”)。 无法正确识别文本时,是否可以在 OCR 中对其进行训练/再训练?

【问题讨论】:

  • 您在应用中使用了哪种 OCR 操作?识别文本,还是阅读?能否提供样张图片?
  • 我使用的是 RecognizePrintedTextAsync 和图像 moderatorsampleimages.blob.core.windows.net/samples/sample2.jpg。它无法识别最后一行“我们自己”中的“S”。此外,将句点识别为逗号。
  • 看起来您实际上是在使用“OCR”操作,而不是“RecognizeText”或“BatchRead”。我将填写回复以指导您获得正确的结果

标签: computer-vision ocr azure-cognitive-services


【解决方案1】:

OCR 工具并非总是能检测到所有内容。您可以尝试在将某些图像发送到 azure 之前对其进行预处理。 Preprocessig

【讨论】:

    【解决方案2】:

    根据您提供的图像和信息,我快速检查了计算机视觉 API 的输出,该 API 包含多个文本处理操作:

    • OCR:原始的,同步的
    • 识别文本:第二个,异步的,最后一个将被弃用
    • 批量读取 (2.0 & 2.1) > 读取 (3.0):最新的,也是异步的。

    就结果质量而言,Read 操作更好,尤其是对于旋转项目和其他情况。

    这是每个图像的输出示例 (https://moderatorsampleimages.blob.core.windows.net/samples/sample2.jpg),由 Cognitive Workbench website(认知服务的开源演示)生成。

    OCR

    你可以看到一些错误:

    • “CAPABLE”后有一个“*”
    • “OURSELVE”缺少“S”
    • 最后一个句点是逗号

    识别文字

    这里唯一的问题是末尾缺少句号

    批量读取

    这里唯一的问题是末尾缺少句号

    结论:使用现在普遍可用的 Read 3.0。 API链接:https://westeurope.dev.cognitive.microsoft.com/docs/services/computer-vision-v3-ga/operations/5d986960601faab4bf452005

    【讨论】:

    • 感谢您的详细回复。根据我最初的问题,这些功能中的任何一个都可以训练/再训练吗?
    • 不,他们不能被训练
    猜你喜欢
    • 2014-07-07
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-11-07
    • 1970-01-01
    • 2020-08-28
    • 1970-01-01
    • 2011-10-18
    相关资源
    最近更新 更多