【发布时间】:2019-05-24 22:36:54
【问题描述】:
我正在创建将发票图像转换为可编辑格式的软件(同时转换文本和表格数据)。到目前为止,我已经在 python 中找到了轮廓来将图像转换为更小的块,这有助于找到文本的位置,Tesseract 用于将这些图像转换为文本。
我已经提取了文本,但现在的问题是将这些文本放在一个简单的记事本或 Word 文档或您建议的任何其他文件中的已知位置。
【问题讨论】:
我正在创建将发票图像转换为可编辑格式的软件(同时转换文本和表格数据)。到目前为止,我已经在 python 中找到了轮廓来将图像转换为更小的块,这有助于找到文本的位置,Tesseract 用于将这些图像转换为文本。
我已经提取了文本,但现在的问题是将这些文本放在一个简单的记事本或 Word 文档或您建议的任何其他文件中的已知位置。
【问题讨论】:
我建议您使用 pytesseract 它的简单 Python 光学字符识别这是一个示例代码
import pytesseract
from PIL import Image, ImageEnhance, ImageFilter
im = Image.open("temp.jpg") # the second one
im = im.filter(ImageFilter.MedianFilter())
enhancer = ImageEnhance.Contrast(im)
im = enhancer.enhance(2)
im = im.convert('1')
im.save('temp2.jpg')
text = pytesseract.image_to_string(Image.open('temp2.jpg'))
print(text)
【讨论】: