【发布时间】:2016-01-31 20:05:40
【问题描述】:
我经常使用扫描的文件。这些论文包含我需要手动输入计算机的表格(类似于 Excel 表格)。为了使任务变得更糟,表格可以具有不同数量的列。至少可以说,将它们手动输入 Excel 是很平常的。
我想如果我可以将一个程序用于 OCR,我可以为自己节省一周的工作时间。是否可以使用 OpenCV 和 OCR 检测标题文本区域,检测图像坐标后面的文本。
我可以在 OpenCV 的帮助下实现这一点,还是需要完全不同的方法?
编辑:示例表实际上只是一个标准表,类似于您在 Excel 和其他电子表格应用程序中看到的,见下文。
【问题讨论】:
-
是的,你可以。但是很难得到 100% 完美的结果,除非你有明确的约束条件。你能展示一些你扫描的表格吗?
-
您能提供一两份扫描文件吗?扫描质量对最终结果有很大影响。
-
这个问题有2个部分: 1. 识别和提取表格 2. OCR 第一部分比较容易,你可以找到类似的教程:shogun-toolbox.org/static/notebook/current/… OCR 比较难。根据我的经验,它足够可靠,只有在高质量扫描或打印字体图像的情况下才需要很少的人工干预。制作 OCR 引擎的方式有很多……从 SVM 到深度学习。您可以找到适合您专业知识的教程。
-
@Datageek,我也在做类似的事情。当每个单元格有更多单词时,如果您设法将行转换为数据,您能分享一下您的经验吗?
标签: opencv computer-vision vision