【发布时间】:2018-02-25 05:40:17
【问题描述】:
在 tesseract documentation 中解释了一种使用示例文本和字体进行训练的方法。
我使用了 jTessBoxEditor,但其工作原理与 tesseract 训练工具非常相似。
我得到了一些可以接受的结果,但我想最佳解决方案是使用它必须识别的实际图像类型来训练 tesseract。
由于我只需要识别数字,我可以手动切割每个数字,也许每个数字的多个版本,并使用这些图像训练 tesseract,甚至手动设置框。
有没有办法做到这一点?
【问题讨论】:
标签: ocr tesseract training-data