【发布时间】:2021-09-10 12:11:24
【问题描述】:
我正在尝试从包含在较宽框中的图像中提取一些非常明显的文本:
但是,Tesseract 无法成功从中提取文本。如果我删除图像中的框,它就可以正常工作:
请注意,当我将字体更改为更常见的字体(例如 Arial)时,这两个图像都可以正常工作。但是,我确实需要让它使用当前字体(影响)。
任何有关如何使其工作的帮助将不胜感激!
以下是我当前的代码:
import cv2
import pytesseract
pytesseract.pytesseract.tesseract_cmd = r'C:\\Program Files\\Tesseract-OCR\\tesseract.exe'
img = cv2.imread('without_box.png') #https://i.stack.imgur.com/vrJvd.png
img_text = pytesseract.image_to_string(img)
print('without_box : ', img_text) #returns "without_box : TEXT"
img = cv2.imread('with_box.png') #https://i.stack.imgur.com/xNEdR.png
img_text = pytesseract.image_to_string(img)
print('with_box : ', img_text) #returns "with_box : "
【问题讨论】:
-
从我个人的经验来看,Tesseract 真的不适合我。如果您的要求是每月少于 1000 张图像,我建议切换到 Google Vision API。前 1000 张图片是免费的,在检查了几乎所有主要的免费和付费 OCR 之后,我发现它是最好的。
-
也许你应该在使用tesseract之前尝试修改图像本身,图像处理会对结果产生巨大影响。
标签: python image-processing ocr tesseract python-tesseract