【发布时间】:2021-11-22 07:34:19
【问题描述】:
我尝试了不同的方法来传递语言,但都没有奏效。代码如下:
dataframe_final=[]
for i in range(len(boxes_list)):
for j in range(len(boxes_list[i])):
s=''
if(len(boxes_list[i][j])==0):
dataframe_final.append(' ')
else:
for k in range(len(boxes_list[i][j])):
y,x,w,h = boxes_list[i][j][k][0],boxes_list[i][j][k][1],
boxes_list[i][j][k][2],boxes_list[i][j][k][3]
roi = bitnot[x:x+h, y:y+w]
kernel = cv2.getStructuringElement(cv2.MORPH_RECT, (2, 1))
border = cv2.copyMakeBorder(roi,2,2,2,2,
cv2.BORDER_CONSTANT,value=[255,255])
resizing = cv2.resize(border, None, fx=2, fy=2,
interpolation=cv2.INTER_CUBIC)
dilation = cv2.dilate(resizing, kernel,iterations=1)
erosion = cv2.erode(dilation, kernel,iterations=2)
plotting = plt.imshow(erosion,cmap='gray')
plt.title("After Erosion")
plt.show()
out = pytesseract.image_to_string(erosion)
if(len(out)==0):
out = pytesseract.image_to_string(erosion)
s = s +" "+ out
dataframe_final.append(s)
打印(dataframe_final)
现在,如果我通过 pytesseract.image_to_string(erosion, lang='fra') 它将不起作用。有没有办法预先定义语言或其他解决方案? 这是侵蚀后产生的图像:
【问题讨论】:
-
这是什么意思:“它不起作用”?您是否也检查了侵蚀(图片)?可以分享一下吗?
-
请立即查看。我编辑了帖子。也许现在有意义
标签: ocr tesseract python-tesseract