【发布时间】:2011-03-29 09:01:20
【问题描述】:
我正在为汉字做 OCR 项目。但问题是我需要让用户在方框中使用他们的光标来选择他们希望系统扫描并识别字符的图像的哪个部分。有谁知道该怎么做?我需要做类似 COCR2 的事情。
【问题讨论】:
-
need help in C# OCR的可能重复
我正在为汉字做 OCR 项目。但问题是我需要让用户在方框中使用他们的光标来选择他们希望系统扫描并识别字符的图像的哪个部分。有谁知道该怎么做?我需要做类似 COCR2 的事情。
【问题讨论】:
我假设您有一个 winforms 项目。有一个带有文本图像的图像框。 您应该将 MouseDown、MouseUp、MouseMove 的事件处理程序添加到您的图片框。 当鼠标按下时,您可以保存图像上那一秒的点是什么,并添加一些布尔值来记住选择开始。
当鼠标抬起时 - 你会看到选择是否开始以及是否开始 - 获取鼠标向下和鼠标向上的坐标并使用类似参数的参数克隆源图像
Image imgforRecognition = image.Clone(start.X, start.Y, end.X, end.Y);
然后你将 imgforRecognition 传递给你的 OCR 引擎。
【讨论】:
我曾经做过一个这样的项目。这是关于模式识别的。你可能最终会使用神经网络,你必须教汉字。
图像库可以从图像中挑选出一块(就像 LexRema 所描述的那样)。完成此操作后,我们将图像部分调整为 10x10 像素,将颜色转换为黑白值(0 和 1)。
这将创建二进制数据的映射。你必须告诉神经网络你传递的数据就是你告诉的字符。这是非常默认的,我相信网络上有很多神经网络示例。
祝你好运!
【讨论】: