【发布时间】:2014-01-22 22:24:35
【问题描述】:
我是 tesseract 库的新手,我在 Ubuntu 12.04 上设置了它。
我正在使用这个data set 来被识别。当我使用this code 将这些图像原样(没有任何预处理)提供给 tesseract 时,我得到了大约 70-75%。准确性。
我希望准确率达到 90+%,所以我做了一些预处理步骤来增强图像
预处理步骤
- 应用底帽算子与半径为 12 的圆的结构化元素
- 图像补全,背景为白色,文字为黑色
- 增强结果图像的对比度
- 腐蚀图像。
在这些步骤之后,我得到非常清晰的图像可以是seen here。但是现在当我使用相同的代码将这些图像提供给 tessearct 时,准确率会降低到 限制 tesseract 进行该预处理。如果不是,那么为什么现在图像非常清晰时它会给我带来不好的结果?如果我问了一些基本问题,请原谅我。
【问题讨论】: