【问题标题】:Is the Google Translate phone app using Tesseract to do OCR locally?谷歌翻译手机应用程序是否使用 Tesseract 在本地进行 OCR?
【发布时间】:2016-07-10 23:28:47
【问题描述】:

与我在 iOS 上使用 Tesseract 编写的测试相比,该应用程序在 OCR 方面非常快速且准确。 所以我想知道: 谷歌翻译手机应用程序是否使用 Tesseract 在本地进行 OCR?或者它是否调用了一些支持 OCR 的 Google 后端,例如 Google Drive API。 Google 或该团队的任何人都知道吗?

【问题讨论】:

  • 是的,我相信 Google 确实将 Tesseract 库用于他们的 Google 翻译应用程序。快速搜索将产生 OCR 库的结果。这是一个链接:antimatter15.com/ocrad.js/demo.html
  • 谢谢@chRyNaN。与我使用 Tesseract 编写的内容相比,Google 翻译的性能和准确性给我留下了深刻的印象,这就是为什么我专门询问有关 Google 翻译手机应用程序的原因。
  • 我不肯定,因为我不是 Google 工程师,但我相当肯定他们在服务器上使用 Tesseract 甚至 Google Drive API。 OCR 是一项非常复杂的任务,并且由于他们对 Tesseract 库的支持,我非常怀疑他们会为他们的应用程序使用完全不同的一个(可能稍微修改但很可能只是包装代码)。此外,网上有足够的资源暗示他们确实使用了 Tesseract。至于您的代码,性能和准确性不存在的原因可能有很多。
  • 我与 Google 没有任何关系,但在另一家移动 OCR 公司工作。根据网络上的不同消息来源,谷歌收购了拥有自己的移动 OCR 的 World Lens 开发人员,我猜想在新版本的谷歌翻译中,他们使用了另一个移动 OCR。 en.wikipedia.org/wiki/Word_Lens

标签: android ios ocr tesseract google-translate


【解决方案1】:

我认为 Google 正在使用他们新的深度学习库 Tensorflow 来处理新的 OCR 内容。卷积神经网络 (CNN) 是 OCR 的最新技术。

Google 还在他们的研究博客上写了一篇博文,介绍他们如何在新的翻译应用中使用深度学习和 CNN (Link to blog post)

【讨论】:

    猜你喜欢
    • 2011-06-23
    • 1970-01-01
    • 2013-05-24
    • 1970-01-01
    • 1970-01-01
    • 2012-03-13
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多