【发布时间】:2013-11-05 20:17:16
【问题描述】:
我正在使用 Tesseract OCR(通过 pytesser)和 PIL(Python 图像库)对应用程序进行自动化测试。
我正在通过截屏并通过 tesseract 获取文本来检查显示的文本是否正常。
一开始我遇到了一些问题,但由于 PIL 的双三次插值,我增加了屏幕截图的大小,所以效果似乎更好。
不幸的是,我仍然有一些错误,例如混淆“0”和“O”。我可以想象我以后还会遇到其他类似的问题。
我想知道是否有一些技术可以准备图像以帮助 OCR。欢迎任何想法。
提前致谢
【问题讨论】:
-
如果这个问题仍然相关:这必须是 Tesseract 吗?有一些 OCR 引擎(例如 ABBYY)非常适合低质量的输入图像,并自动为您进行图像预处理。 wisetrend.com/wisetrend_ocr_cloud.shtml 有一个用于 OCR 的 REST API,它使用 ABBYY 引擎 - 它提供免费试用版,因此您可以自己尝试一些图像