【发布时间】:2010-12-25 16:56:42
【问题描述】:
在我的工作中,有时我必须获取一些打印的源代码并手动将源代码输入文本编辑器。不要问为什么。
显然,输入它需要很长时间,而且总是需要额外的时间来调试输入错误(哎呀,那里漏掉了一个“$”符号)。
我决定尝试一些 OCR 解决方案,例如:
- Microsoft Document Imaging - 内置 OCR
- 结果:遗漏了所有前导空格、遗漏了所有下划线、错误地解释了许多标点字符。
- 结论:比手动输入代码慢。
- 各种在线网络 OCR 应用程序
- 结果:与 Microsoft Document Imaging 相似或更差
- 结论:比手动输入代码慢。
鉴于字体是无衬线和等宽字体,我觉得源代码很容易进行 OCR。
你们有没有找到一个很好的 OCR 解决方案,可以很好地处理源代码?
也许我只是需要一个更好的 OCR 解决方案(不一定是特定于源代码的)?
【问题讨论】:
标签: ocr