【发布时间】:2016-02-13 01:55:16
【问题描述】:
我已经在这个项目上工作了几个月,需要一些帮助。我正在尝试识别来自旧相机的图像上的字符,该相机使用七段 LED 将帧号印在图像的右下角。问题是这些图像是人的,并且肤色与一些肤色较浅的图像相混淆。但是大多数情况下通常不能被传统的 OCR 识别,我正在尝试使用 Tesseract,但在编译应用程序时未能成功,只是为了对其进行测试和训练。我在这里问是否有其他人有类似的问题或知道 Tesseract 的替代品能够识别这些字符。最好是可训练的 ocr。我的搜索结果为空。
【问题讨论】:
-
您要处理多少张图片?因为您可能需要进行机器学习,而这很难正确。对于较小的数字(例如 1000),您最好手动输入数据或通过 Mechanical Turk 雇佣劳动力或其他方式?
-
我相信每天最多 3,500 个,但平均约为 1k
-
这是一个连续的工作流?我猜你确实想要一些自动化。
-
这个 ocr 将被插入到我们正在构建的另一个外部应用程序中。
标签: java image-processing ocr tesseract seven-segment-display