【问题标题】:Can you train tesseract with images instead of text and a font?你能用图像而不是文本和字体来训练 tesseract 吗?
【发布时间】:2018-02-25 05:40:17
【问题描述】:

在 tesseract documentation 中解释了一种使用示例文本和字体进行训练的方法。
我使用了 jTessBoxEditor,但其工作原理与 tesseract 训练工具非常相似。
我得到了一些可以接受的结果,但我想最佳解决方案是使用它必须识别的实际图像类型来训练 tesseract。
由于我只需要识别数字,我可以手动切割每个数字,也许每个数字的多个版本,并使用这些图像训练 tesseract,甚至手动设置框。
有没有办法做到这一点?

【问题讨论】:

    标签: ocr tesseract training-data


    【解决方案1】:

    如果你想训练 tesseract4,你可以使用ocrd-train 您基本上准备了与每行文本相对应的图像及其基本事实,它会为您完成所有剩余的工作。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-05-08
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-09-12
      相关资源
      最近更新 更多