【问题标题】:How to set Tesseract 2 to read a SINGLE char in C#?如何设置 Tesseract 2 在 C# 中读取单个字符?
【发布时间】:2013-04-01 05:53:05
【问题描述】:

我正在用 C# 编写一个简单的 OCR,我正在使用 tesseract 2.0

在我的程序中,我只能识别大写字母。

因此我使用:

Tesseract ocr = new Tesseract();
ocr.SetVariable("tessedit_char_whitelist", "ABCDEFGHIJKLMNOPQRSTUVWXYZ");

所以此时我将传递一个大写字母的图像。 它工作得很好,但有时它会返回一个带有两个字母的字符串。

Input:
R
Output:
FE

现在我需要知道如何将页面分割模式设置为“单字符”。以改善结果。

有人知道如何在 C# 中使用 tesseract 2 做到这一点吗?

因为在 Tesseract ocr 对象中我只有 SetVariable 方法。 在 iOS apis 中有这种方法可以做到这一点:

setPageSegMode(TessBaseAPI.PSM_SINGLE_CHAR);

谁能帮帮我?

【问题讨论】:

    标签: c# ocr tesseract image-recognition


    【解决方案1】:

    PSM 仅在 Tesseract 3.0x 中可用;因此,您需要一个兼容的 .NET 包装器。 https://github.com/charlesw/tesseract 有一个。

    【讨论】:

    • 非常感谢您回答我的问题。简单、简短且很好的答案。
    • 使用上述包装器,您必须致电tesseract.Process(picture, Tesseract.PageSegMode.SingleChar);
    猜你喜欢
    • 2013-01-03
    • 1970-01-01
    • 1970-01-01
    • 2021-07-01
    • 1970-01-01
    • 1970-01-01
    • 2013-11-25
    • 2011-01-31
    • 1970-01-01
    相关资源
    最近更新 更多