【发布时间】:2011-10-15 18:19:14
【问题描述】:
我正在编写 OCR 识别程序。它适用于扫描文本,但是有两个问题:
- 它会在照片上产生误报(一些垃圾随机文本,例如“bkigopes”)
- 运行速度很慢
目标是找到所有带有文本的图像并提取此文本。所以,鉴于提到的问题,我需要快速拒绝照片。我希望有一些数学(统计)方法,比如计算一些中位数,可以很容易地确定彩色图像,而不像扫描文本那样有明显的结构。
这种方法/公式不应被特殊类型的图像所欺骗,例如带有屏幕截图的文本或带有大量文本和图片的杂志页面。此外,不应拒绝彩色文本(例如黄底红字)。
有没有人遇到过这样的问题?有什么想法或现成的解决方案吗?
【问题讨论】:
标签: algorithm image-processing ocr statistics