【发布时间】:2013-04-01 05:53:05
【问题描述】:
我正在用 C# 编写一个简单的 OCR,我正在使用 tesseract 2.0
在我的程序中,我只能识别大写字母。
因此我使用:
Tesseract ocr = new Tesseract();
ocr.SetVariable("tessedit_char_whitelist", "ABCDEFGHIJKLMNOPQRSTUVWXYZ");
所以此时我将传递一个大写字母的图像。 它工作得很好,但有时它会返回一个带有两个字母的字符串。
Input:
R
Output:
FE
现在我需要知道如何将页面分割模式设置为“单字符”。以改善结果。
有人知道如何在 C# 中使用 tesseract 2 做到这一点吗?
因为在 Tesseract ocr 对象中我只有 SetVariable 方法。 在 iOS apis 中有这种方法可以做到这一点:
setPageSegMode(TessBaseAPI.PSM_SINGLE_CHAR);
谁能帮帮我?
【问题讨论】:
标签: c# ocr tesseract image-recognition