【发布时间】:2017-03-07 21:14:20
【问题描述】:
我已经运行了 tesseract ocr 将图像文件转换为字符串。
现在我有输出了
我如何比较原始PNG文件和输出文本文件的准确性是否正确
basewidth = 2700
img = Image.open('D:OCR\\page1.png')
wpercent = (basewidth/float(img.size[0]))
hsize = int((float(img.size[1])*float(wpercent)))
img = img.resize((basewidth,hsize), PIL.Image.ANTIALIAS)
img.save('page1_zoom.png')
print(image_to_string(Image.open('D:\page1_zoom.png')))
【问题讨论】:
-
您需要手动注释数据。
-
“比较原始PNG文件和输出文本文件是否准确”是什么意思?您是否尝试使用 OCR 验证 OCR?通常你会手动验证这种事情。
-
你在乞求这个问题 - 要验证 OCR,你需要另一个更准确的 OCR - 你没有。这意味着您可以手动验证它。
标签: python ocr tesseract floating-accuracy