【发布时间】:2019-03-14 20:06:57
【问题描述】:
我目前正在从事一个项目,该项目将读取数独网格的图像,检测网格,识别数字,解决难题,并将解决方案覆盖在图像上。为了识别数字,我将网格划分为 n*2 个图像,其中每个图像都是一个单独的网格(例如:ex2ex9),然后将它们运行到 pytesseract。然而,我的所有图像都没有检测到任何文本,即使它只是一个没有噪音/边框/等的数字图像。
我尝试了平滑图像、各种阈值处理方法、调整图像大小、反转图像以及将数字裁剪到边界框的常用方法,但这些方法似乎都不起作用。我已经在其他图像上测试了我为 pytesseract 编写的代码,这些代码似乎都可以正常工作,只是我的图像无法正常工作。
谁能就我可以尝试什么和/或为什么我的图像似乎不容易处理提供建议?
作为参考,这里是我一直在使用的 pytesseract 的 image_to_string 的设置:
text = image_to_string(im, config='--psm 10 --oem 3' + '-c tessedit_char_whitelist=123456789')
【问题讨论】:
标签: python ocr tesseract sudoku python-tesseract