【问题标题】:OCR on images using python and opencv使用 python 和 opencv 对图像进行 OCR
【发布时间】:2018-06-20 00:12:18
【问题描述】:

我是计算机视觉、图像处理和 OCR 的新手。作为任务的一部分,我需要对附加的电子邮件执行 OCR。然而,问题是 ROI 在所有图像中都不是恒定的。例如,在所有图像中,我们需要提取与患者 Yadav 相关的信息。

这需要在 Python 和 OpenCV 中实现。请帮忙。我已经尝试过以下方法:

  1. 更改 DPI
  2. 灰度
  3. 二值化
  4. 但是,面临布局或区域分析的问题。

感谢您的帮助。

【问题讨论】:

  • “为我编写代码”不是问题。您应该开始编写代码,然后在遇到特定问题时再回来。
  • 亲爱的 jdv ......如果我需要编写代码,我应该从哪里开始。我应该从一开始或以后专注于投资回报率领域。如果我需要开始关注投资回报率,那么如何……方法是什么。因为这个领域有很多投资回报率。
  • 本网站不是“为我设计代码”服务。没有人会为你做这件事。您需要某种教程或指南,可以在网上搜索。例如:“OpenCV ROI 示例”
  • 顺便说一句,我真的希望您显示的这些数据是虚拟数据...
  • 是的.....这是一个虚拟数据

标签: python opencv ocr


【解决方案1】:

欢迎来到计算机视觉世界。

我认为您对问题的理解不够好。只是尝试一些东西并检查它是否有效是永远不会奏效的。

首先在https://github.com/tesseract-ocr/tesseract/wiki/ImproveQuality阅读 tesseract(OCR 引擎)如何提高其准确性

好的,那么是什么让 OCR 无法处理您的数据。如您所见,您的数据很干净,几乎没有噪音。所以这是打印电子邮件的边界(如您的问题中的“ROI”)没有正确排列。

所以我们可以让投资回报率正确排列。我们可以使用一些透视变换。我举了https://www.pyimagesearch.com/2014/08/25/4-point-opencv-getperspective-transform-example/的例子

那么我们如何进行透视变换。我们必须找到 ROI 的 4 个角并将其移回图像的角。要找到 ROI 的 4 个角,您可以找到一些轮廓。

这里是总结,这里是步骤。

1. Find the ROI (white color) using color segmentation
2. Find the contour which cover the ROI
3. Find 4 corners of the ROI's contour
4. Apply perspective transform
5. Run tesseract on transformed image

希望有所帮助

【讨论】:

    猜你喜欢
    • 2015-05-10
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-04-14
    • 1970-01-01
    • 2020-01-25
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多