【发布时间】:2012-11-01 17:06:51
【问题描述】:
是否有免费的 OCR 库可以提取文本以及检测文本上的某些标记?我意识到这是一个非常模糊的命题,并且这种功能将高度依赖于我想要检测的“标记”类型。
但据我所知,甚至不存在这样的东西,除了一些声称将扫描页面转换为可编辑文件同时保留原始页面布局外观的商业软件包。我正在寻找一个与我一起编程的 LIBRARY。
我对这样一个库的具体应用是这样的:
- 打印一页。
- 用铅笔在关键词下划线。
- 扫描页面。
- 运行一个程序,将扫描的页面图像转换为某种文本格式,以标记每个带下划线的单词。例如,一个 RTF 文件,其中每个带铅笔下划线的单词都加粗了。
【问题讨论】:
-
您确定要使用 OCR 吗?如果您有原始文件可供您使用,我认为这会打开更简单的场所......
-
你是说人手?当然可以,但我问的是 AUTOMATIC 功能。
-
不,我的意思是,如果您有可用的原始数字文档(毕竟您是在谈论打印它),您可以自动完成更简单的事情。
-
例如,您可以将第二个副本“打印”到图像上,然后将该图像与您的扫描结果进行比较。从那里,您只需要确定哪些差异是噪音,哪些是下划线,您必须找到一种方法将图像中的位置转换为原始文档中的单词。我想说这些任务更容易编程,你的结果也会更好。
标签: ocr