【发布时间】:2014-11-21 04:30:03
【问题描述】:
我正在开发一种 OCR 来检测信用卡。
扫描图像后,我得到一个包含位置的单词列表。 关于检测信用卡的每个字段(号码、日期、姓名)对应的单词的最佳方法的任何提示/建议?
例如:
position = 96.00 491.00
text = CARDHOLDER
提前致谢
【问题讨论】:
-
据我所知,某些字段(卡号、持卡人姓名、开始/到期日期)的位置是标准化的(不是 100% 确定,如果错误请更正。)所以这是一个专业的分割算法启发式地将图像分解成某些区域的情况可以真正帮助你。大多数 OCR(例如 Tesseract)都针对连续文本页面或具有多列的文本进行了优化(有时它们与列有冲突)。在这种情况下,您想了解如何覆盖或提示使用的页面分割算法,或编写您自己的预处理程序。