【发布时间】:2015-05-23 17:07:15
【问题描述】:
我正在尝试编写一个代码,给定一个图像,它将在整个图像上运行 tessearct 并返回检测到文本的所有位置的地图(作为二进制图像)。
不一定是逐个像素的,边界框的联合就足够了。
有没有办法做到这一点?
提前致谢
【问题讨论】:
我正在尝试编写一个代码,给定一个图像,它将在整个图像上运行 tessearct 并返回检测到文本的所有位置的地图(作为二进制图像)。
不一定是逐个像素的,边界框的联合就足够了。
有没有办法做到这一点?
提前致谢
【问题讨论】:
是的……(当然)。查看 Python 图像库以加载图像并对其进行裁剪。然后你可以在每一块上应用 Tesseract 并检查输出。
看看at the program我刚才回答了。它可能会帮助您获得所需的元素。它允许您手动选择和区域,并对其进行 OCR。但这很容易改变。
【讨论】:
union of bounding boxes 你的意思是在 N x M 个盒子中细分图像,例如?然后应用 OCR?