【问题标题】:How do I select a different language in pytesseract? I tried few methods but none worked如何在 pytesseract 中选择不同的语言?我尝试了几种方法,但都没有奏效
【发布时间】:2021-11-22 07:34:19
【问题描述】:

我尝试了不同的方法来传递语言,但都没有奏效。代码如下:

dataframe_final=[]
for i in range(len(boxes_list)):
  for j in range(len(boxes_list[i])):
    s=''
    if(len(boxes_list[i][j])==0):
        dataframe_final.append(' ')
    else:
        for k in range(len(boxes_list[i][j])):
            y,x,w,h = boxes_list[i][j][k][0],boxes_list[i][j][k][1], 
            boxes_list[i][j][k][2],boxes_list[i][j][k][3]
            roi = bitnot[x:x+h, y:y+w]
            kernel = cv2.getStructuringElement(cv2.MORPH_RECT, (2, 1))
            border = cv2.copyMakeBorder(roi,2,2,2,2, 
            cv2.BORDER_CONSTANT,value=[255,255])
            resizing = cv2.resize(border, None, fx=2, fy=2, 
            interpolation=cv2.INTER_CUBIC)
            dilation = cv2.dilate(resizing, kernel,iterations=1)
            erosion = cv2.erode(dilation, kernel,iterations=2)   
            plotting = plt.imshow(erosion,cmap='gray')
            plt.title("After Erosion")
            plt.show()             
            out = pytesseract.image_to_string(erosion)
            if(len(out)==0):
                out = pytesseract.image_to_string(erosion)
            s = s +" "+ out
            dataframe_final.append(s)

打印(dataframe_final)

现在,如果我通过 pytesseract.image_to_string(erosion, lang='fra') 它将不起作用。有没有办法预先定义语言或其他解决方案? 这是侵蚀后产生的图像:

【问题讨论】:

  • 这是什么意思:“它不起作用”?您是否也检查了侵蚀(图片)?可以分享一下吗?
  • 请立即查看。我编辑了帖子。也许现在有意义

标签: ocr tesseract python-tesseract


【解决方案1】:
  1. 您仍然没有解释“它不起作用”是什么意思?
  2. 为什么要使用语言来识别数字???没有意义
  3. 根据您的图像:您是否尝试对 120 像素高的字母进行 OCR?请先阅读 tesseract 文档。

【讨论】:

    猜你喜欢
    • 2019-12-14
    • 1970-01-01
    • 1970-01-01
    • 2023-03-24
    • 2019-07-10
    • 2017-11-09
    • 1970-01-01
    • 2020-05-10
    • 2021-05-18
    相关资源
    最近更新 更多