【发布时间】:2021-08-20 20:33:01
【问题描述】:
我猜这是因为我拥有的图片在图片顶部包含文字。 pytesseract.image_to_string() 通常可以正确扫描文本,但它也会返回大量乱码:我猜这是因为文本下方的图片使 Pytesseract 认为它们也是文本或其他东西。
当 Pytesseract 返回一个字符串时,我怎样才能使它不包含任何文本,除非它确定文本是正确的。 比如,如果 Pytesseract 有办法返回某种数字,告诉我文本扫描的准确性如何?
我知道我听起来有点笨,但请有人帮忙
【问题讨论】:
-
(1)您的代码和(2)您的图像在哪里? Stack Overflow 不是免费的代码编写服务。您应该尝试自己编写代码。在完成more research 之后,如果您有问题,您可以发布您尝试过的内容,并清楚地解释什么不起作用并提供minimal reproducible example。我建议阅读How to Ask a good question。另外,请务必take the tour
标签: python python-tesseract pytesser