【发布时间】:2021-07-26 00:36:14
【问题描述】:
我已经针对我生成的一组约 30,000 个地面实况图像训练了一个 Tesseract 4 LSTM 模型(而不是使用来自扫描作品的“真实”图像,我没有足够的数据来可靠地训练模型)。
该模型运行良好(或至少比它所基于的eng 更好)。图像生成脚本有几个我可以调整的参数,但我想以一种更“有序”的方式来做这件事,而不是仅仅关注输出,所以我想根据一个(小得多)的精度生成指标一组真实世界的图像。
但是,我不清楚如何获取一组线条图像和地面实况文本文件并生成所需的文件以在新模型上运行 lstmeval。当评估图像与最初用于训练模型的实际图像无关时,如何生成数据以提供给lstmeval?
【问题讨论】:
标签: lstm ocr tesseract tesstrain