【发布时间】:2021-06-06 01:59:07
【问题描述】:
我有这样的图像:
但是字符之间仍然有一些相关的东西,当我调用tesseract.image_to_text() 函数时会导致错误的结果。结果是BO09804,有没有办法分离图像中的每个字符或应用一些过滤器?
这是我的代码:
src = cv.imread(cv.samples.findFile('path/to/image.jpg'))
src = image_resize(src, height=128, inter=cv.INTER_CUBIC)
gray = cv.cvtColor(src, cv.COLOR_BGR2GRAY)
rect, binary = cv.threshold(gray , 180, 255, cv.THRESH_BINARY | cv.THRESH_OTSU)
kernel = np.ones((5, 5), np.uint8)
dilated = cv.dilate(binary, kernel, iterations=1)
cv.imshow('dilated', dilated)
cv.waitKey(0)
【问题讨论】:
-
这不是很有帮助,但基本问题是您的图像质量;你能得到一个不使用 jpeg 压缩的更高分辨率的扫描吗?
-
当扫描仪机器只提供 jpg 或 jpeg 时,我别无选择:|
标签: python opencv python-tesseract