【问题标题】:improve ocr accuracy from a bbox of a Text Detector从文本检测器的 bbox 提高 ocr 准确性
【发布时间】:2019-07-25 23:19:40
【问题描述】:

我正在使用 tesseract 从图像中提取文本,这是我使用文本检测器获得的车牌图像

from PIL import Image
import pytesseract
import cv2

img= cv2.imread('text0.jpg')
print (pytesseract.image_to_string(th))

但是,它没有给出确切的文本,我可以使用任何过滤器来提高图像的质量吗? 请查看并提供反馈。

【问题讨论】:

    标签: python ocr tesseract


    【解决方案1】:

    你应该确保文本是水平的,我希望这个修改会有所帮助

    from PIL import Image
    import pytesseract
    import cv2
    
    img= cv2.imread('text0.jpg',0)
    h,w= img.shape
    img= cv2.resize(img, (w*2,h*2)) 
    retval2,th = cv2.threshold(img,35,255,cv2.THRESH_BINARY+cv2.THRESH_OTSU)
    
    print (pytesseract.image_to_string(th))
    

    您可以尝试其他方法,例如模糊和更改对比度。

    【讨论】:

    • 我还是个新手,你能解释一下这个函数是做什么的 retval2,th = cv2.threshold(img,35,255,cv2.THRESH_BINARY+cv2.THRESH_OTSU)
    猜你喜欢
    • 2021-01-13
    • 1970-01-01
    • 2011-06-07
    • 2021-06-30
    • 2017-04-03
    • 2014-12-23
    • 1970-01-01
    • 2013-12-10
    • 1970-01-01
    相关资源
    最近更新 更多