【发布时间】:2015-06-10 00:56:51
【问题描述】:
所以我有以下图像:
我正在尝试提取三个数组:
var a = [30,31,32,35,37,40,44];
var b = [6,7,11,15,18,21,22];
var c = [5,11,15,18,23,37,28];
我尝试将此图像输入tesseract ~/Desktop/test.png out 无济于事:
9 % ooenesew @
5 ‘ 904399
这是ocrad ~/Desktop/test.ppm的结果:
o
?
28
任何 OCR 专家都可以建议我接下来可以尝试什么吗?我很喜欢使用 Python/OpenCV,但会尝试任何方法。
【问题讨论】:
-
不是 OCR 专家,但您知道您总是要以相同的比例扫描不倾斜的图像吗?你知道每个可能的数字(我假设是 1-50 左右)是什么样的吗?如果是这样,您可以将此问题从 OCR 减少到特征匹配。
-
您好,它始终是非偏斜的并且具有相同的比例。数字范围实际上是 [1-45]。是的,我也许可以进行特征匹配。
-
这似乎是一种相当不寻常的字体,而且您只是试图匹配非常有限的一组字符。所以我认为你需要先Train Tesseract。