【问题标题】:Bounding boxes around text regions with different font size [closed]具有不同字体大小的文本区域周围的边界框[关闭]
【发布时间】:2017-11-16 11:53:32
【问题描述】:
我正在尝试实现某种文本检测算法,并且我想将图像分成多个区域,每个区域包含不同的字体大小。
如图所示,例如:
是否有任何简单的方法可以使用 python 和/或 opencv 来实现它?如果有,怎么做?
我确实尝试过谷歌搜索但找不到任何有用的东西..
谢谢。
【问题讨论】:
标签:
python
opencv
image-processing
ocr
【解决方案1】:
这是一个有趣的问题。为了实现您的目标,您需要采取一些步骤。我希望您充分了解基本的计算机视觉算法(openCV 函数知识会有所帮助)以理解我建议的步骤。
- 使用形态膨胀过程将所有单词组合在一起。
- 使用 openCV findcountour 函数标记所有的 blob。这还将为您提供每个 blob 的宽度和高度信息。
- 这里是棘手的部分,既然您在每个 blob 上都有数据,请尝试使用位置(x,y)和几何(宽度,高度)作为特征对数据运行聚类算法。
- 正确聚类后,只需找到最左侧、最右侧、最顶部和底部的数据来绘制边界矩形。
我希望这将为您提供足够的信息来开始您的工作。它不详细,但我认为它足以指导你。