【问题标题】:Get a map of where text was detected using tesseract in Python获取在 Python 中使用 tesseract 检测到文本的位置的地图
【发布时间】:2015-05-23 17:07:15
【问题描述】:

我正在尝试编写一个代码,给定一个图像,它将在整个图像上运行 tessearct 并返回检测到文本的所有位置的地图(作为二进制图像)。

不一定是逐个像素的,边界框的联合就足够了。

有没有办法做到这一点?

提前致谢

【问题讨论】:

    标签: python tesseract


    【解决方案1】:

    是的……(当然)。查看 Python 图像库以加载图像并对其进行裁剪。然后你可以在每一块上应用 Tesseract 并检查输出。

    看看at the program我刚才回答了。它可能会帮助您获得所需的元素。它允许您手动选择和区域,并对其进行 OCR。但这很容易改变。

    【讨论】:

    • 这听起来像是你在解决一个非常不同的问题。
    • 完全注意。海报想要绘制一个窗口,并在该窗口中进行 OCR。但是,如果您丢弃程序的那一部分(进行选择),那么您可以在一个小循环中计算细分,并在每个细分中进行 OCR。在原始程序中,目标是用识别的数字重命名文件。你也可以把那部分扔掉。程序会变得更短!
    • union of bounding boxes 你的意思是在 N x M 个盒子中细分图像,例如?然后应用 OCR?
    • 我读到完全相反:OP想要检测文本,并使用找到的文本的位置来绘制一个窗口。
    • 对于窗口,我的意思不是在图像上画一些东西,而是提取一个“矩形”数据,分析它的文本。反正发帖人好像不是来纠正我们的?
    猜你喜欢
    • 2023-02-01
    • 2012-08-27
    • 1970-01-01
    • 1970-01-01
    • 2016-05-05
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2013-12-13
    相关资源
    最近更新 更多