【问题标题】:OCR Time stamp extraction with complex background具有复杂背景的 OCR 时间戳提取
【发布时间】:2021-02-18 21:45:40
【问题描述】:

这是从闭路电视视频中截取的图像,我想从快照中提取时间戳。 OpenCV/Tesseract/python 是这项工作的工具:

这里的困难是复杂的背景,所以即使我用中值过滤器(opencv)对图片进行二值化,ocr 结果仍然很糟糕。当然,我可以应用特定的自定义阈值,但在这里我遇到了 2 个问题:

  1. 如何处理既有白色又有黑色的字符?
  2. 有没有办法(某些方式)为这类图片提供更通用的阈值?

也许我在这里处理预处理的想法是不正确的。在发送到 Tesseract 之前对这种图像进行预处理似乎不是一件容易的事。任何提示和想法都非常感谢。

【问题讨论】:

  • 只为白色 (255) 和黑色 (0) 像素屏蔽图像。然后查看结果。

标签: python opencv ocr tesseract


【解决方案1】:
  1. 进行两次阈值处理,一次通常用于 254 以上的白色像素,一次用于倒置图片:img = cv2.bitwise_not(img),然后合并两个结果

  2. OpenCV 中有一个inRange 函数,您可以在其中设置最小/最大 HSV 值。使用此 HSV 值的输入参数创建一个函数,将值记录在列表中,然后使用 for 循环屏蔽+合并

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2021-07-15
    • 1970-01-01
    • 2014-11-17
    • 2022-08-24
    • 2017-02-21
    • 1970-01-01
    • 2018-05-23
    • 1970-01-01
    相关资源
    最近更新 更多