【发布时间】:2013-05-12 16:28:37
【问题描述】:
我有一个小问题。我尝试测试一个示例。使用 OCR (Tess4J) Tesseract java 和 eclipse 从图像(扫描文本)中获取文本。
File imageFile = new File("D:\\HEAD2.png");
Tesseract instance = Tesseract.getInstance(); // JNA Interface Mapping
// Tesseract1 instance = new Tesseract1(); // JNA Direct Mapping
try {
String result = instance.doOCR(imageFile);
System.out.println(result);
} catch (TesseractException e) {
System.err.println(e.getMessage());
}
这是我配置应用程序的方式:
1)下载Tess4J包含的文件夹(tess4j.jar、文件夹tessdata、libtesseract302.dll、liblept168.dll)
2)我在应用程序的路径中添加jar 3)我在应用程序的当前目录中添加另一个
最后,该示例运行良好。 但是今天,当我执行这个例子时,他提到了我错误
打开数据文件 \Application 时出错 Data\Tesseract-OCR\tessdata/eng.traineddata 请确保 TESSDATA_PREFIX 环境变量设置为的父目录 你的“tessdata”目录。加载语言“eng”Tesseract 失败 无法加载任何语言!
在 C:\programFiles\TesseractOCR 中下载 tesseractOCR.exe 后,它工作正常 但是当也删除这个程序时也可以正常工作..waht是这个程序的作用
即使没有instance.setDatapath("C:\\Program Files\\Tesseract-OCR");,它也能正常工作
.我不明白!!
【问题讨论】:
-
解释可以在stackoverflow.com/questions/18095708/…帖子中找到。
标签: tesseract