【发布时间】:2018-05-12 00:10:35
【问题描述】:
我正在做一个项目来帮助我的视障朋友,一个 python 脚本将首先每秒截取一个屏幕截图,图像上的任何内容都将转换为文本,最接近光标坐标的字符, 将是输出。
用户可以将光标移动到屏幕上的任意位置,离光标最近的字母将是程序的输出。
不要担心输出的形式,它会以音频的形式出现。但是为了简单起见,我们假设它是单字符文本的形式。
我能找到的每个教程都解释了如何使用 OCR 依赖项将所有文本转换为连续的文本文件。
对于我的特定应用程序,每个字母表都将与一个特定的坐标相关联。但我只是找不到单一资源来学习如何识别图像上转换字符的位置。
请教我如何从图像中提取字符的坐标。
【问题讨论】:
-
对于您的视障朋友,我建议您使用 Knoppix Adriane,它是一个专为视障人士或盲人开发的 Linux 发行版:knopper.net/knoppix-adriane/index-en.html 它非常好,并且可以阅读您输入的内容每秒 OCR 一个屏幕截图。
标签: python python-3.x image-processing ocr opencv3.1