【问题标题】:Can we use Yolo to detect and recognize text in a image我们可以使用 Yolo 来检测和识别图像中的文本吗
【发布时间】:2017-03-24 15:24:54
【问题描述】:

目前我正在使用一个名为“Yolov2”的深度学习模型进行对象检测,我想用它来提取文本并将其保存在磁盘中,但我不知道该怎么做,如果有人的话了解更多,请给我建议

我使用张量流

谢谢

【问题讨论】:

  • 您的模型经过了对象检测训练,但您想用它来提取文本?两者似乎不相容。你能更详细地解释你想做什么吗?
  • 实际上我想做的是从图像中提取对象,如果某些图像是带有特殊标签“例如车牌”的标签,我想获取这个对象并提取文本显示在上面,我该怎么做?
  • 嗨@KamelBOUYACOUB,您是否尝试过在单词周围使用边界框训练图像以检测测试图像中相似的书面单词(字体)。我们还尝试了 YOLO 暗网从表单中提取用户手写数据。对于测试图像中相同的用户手写数据。如果图像具有不同的颜色强度会很好,但如果图像旋转则不好。我们在 yolo.cfg 模型中使用了预训练的深色权重。请在此分享您的发现
  • @donald,您能否分享更多有关您从表单中提取手写文本的工作的信息?
  • @donald 可以分享从表单中提取的文本吗?

标签: tensorflow deep-learning text-recognition


【解决方案1】:

如果您使用预训练模型,则需要保存这些输出并将图像输入字符识别网络(如果使用神经网络或其他方法)。

您正在做的是“场景文本识别”。您可以查看使用卷积神经网络在野外阅读文本paper,这是demohomepage。 Github 用户 chongyangtao 拥有完整的list 资源。

【讨论】:

    【解决方案2】:

    我有一个类似的问题,我正在使用 svhn 数据集制作数字检测模型。这还不是一个完成的项目,但它似乎运作良好。你可以在Yolo-digit-detector看到代码。

    【讨论】:

    • S/O 评论:@penny 请尝试详细解释您的答案。简单地发布链接不会增加价值,也不允许在 S/O 上。我可能应该将此标记为“不是答案”,但我认为您可能对此有一些价值,所以我想给您一个分享的机会!始终尝试尽可能全面,并确保您的答案实际上包含问题的答案。与问题相关的实际代码示例将非常有益。
    猜你喜欢
    • 1970-01-01
    • 2020-06-02
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-02-09
    相关资源
    最近更新 更多