【问题标题】:Parsing pdf files using apache camel使用 apache camel 解析 pdf 文件
【发布时间】:2013-10-30 06:10:03
【问题描述】:

如何使用 Apache Camel 读取/解析 pdf 文件。任何特定的示例或代码 sn-ps 来解析文件? 感谢您的帮助。

提前致谢。

【问题讨论】:

    标签: java pdf apache-camel fileparsing


    【解决方案1】:

    您可以使用Apache Tika project 从您的 PDF 文件中提取数据。它是从各种类型的文档中提取数据的通用工具。它在 PDF 引擎盖下使用 PDFBox。

    【讨论】:

      【解决方案2】:

      Camel 根本不是解析任何文件。你可能想看看Apache PDFBox

      【讨论】:

        【解决方案3】:

        有一个 camel-fop 组件:http://camel.apache.org/fop,但它仅用于渲染 pdf 文件。不支持解析 pdf 文件。

        【讨论】:

        • 感谢您的更新。
        【解决方案4】:

        实际上使用camel的组件pdf你也可以提取文本,你可以在这里看到一个如何做到这一点的例子:https://github.com/apache/camel/blob/master/components/camel-pdf/src/test/java/org/apache/camel/component/pdf/PdfTextExtractionTest.java

        该组件基于 Apache PDFBox: https://camel.apache.org/components/latest/pdf-component.html

        【讨论】:

          猜你喜欢
          • 2013-03-22
          • 2011-12-31
          • 1970-01-01
          • 2013-07-24
          • 1970-01-01
          • 1970-01-01
          • 1970-01-01
          • 1970-01-01
          • 1970-01-01
          相关资源
          最近更新 更多