【发布时间】:2022-02-02 02:28:42
【问题描述】:
我一直在尝试使用 tesseract 将此图像的输出作为文本。我尝试了很多方法,但无法做到。我认为这与切割字母的那条线有关,但您可能仍想尝试。我是新手,认为你们专家可以做到。
这是我的代码:
from pytesseract import image_to_string
from PIL import Image
import base64
from io import BytesIO
from selenium import webdriver
from selenium.webdriver.remote.webelement import WebElement
from selenium.webdriver.support.ui import Select
from selenium.webdriver.common.keys import Keys
from selenium.webdriver.support import expected_conditions as EC
from webdriver_manager.chrome import ChromeDriverManager
from selenium.webdriver.common.by import By
import csv
import time
import cv2
import pytesseract
import imutils
from pytesseract import Output
img = cv2.imread('canvas.png')
image = imutils.resize(img, width=700)
gray = cv2.cvtColor(image, cv2.COLOR_BGR2GRAY)
thresh = cv2.threshold(gray, 0, 255, cv2.THRESH_BINARY_INV + cv2.THRESH_OTSU)[1]
thresh = cv2.GaussianBlur(thresh, (3,3), 0)
pytesseract.pytesseract.tesseract_cmd = r'C:\Program Files\Tesseract-OCR\tesseract.exe'
data = pytesseract.image_to_string(thresh, lang='eng', config='--psm 6')
print(data)
感谢您的帮助。
我得到的输出是:SHY AR(不正确,应该是3HYXK)
【问题讨论】:
-
我的输出是 SHY AR。
标签: python opencv ocr captcha python-tesseract