【发布时间】:2011-12-05 19:00:00
【问题描述】:
我在一些图像中使用 Tesseract 2.04 执行 OCR,现在我必须得到文本的精确位置。但此版本不返回此信息。
我需要这个来生成一个可搜索的 pdf 文件。我已经学会了如何在 pdf 的底层中标记文本,但我需要标记该文本的位置。 我的第一个想法是在pdf中执行ocr,获取文本和文本的位置,用iText api在pdf中标记。
【问题讨论】:
-
你可能想看看这个问题:stackoverflow.com/questions/8263954/…
-
感谢您的评论。
标签: java pdf itext ocr tesseract