【问题标题】:itextsharp read table [closed]itextsharp读取表[关闭]
【发布时间】:2010-02-05 10:14:03
【问题描述】:

我使用 itextsharp 创建了一个带有表格的 pdf。我在http://itextsharp.sourceforge.net/tutorial/ch05.html 找到了一个例子。现在我想再次使用 itextsharp 从表中读取数据。我找不到任何关于如何读取这些数据的文档。谁能给我一个例子?

【问题讨论】:

  • 没有人有好的样品吗?
  • 你找到了读取表格内容的解决方案吗?

标签: c# pdf itext


【解决方案1】:

很遗憾,您不能在 iTextSharp 中执行此操作。 SourceForge 上标题为 "Advanced: reading PDF" on the iTextSharp page 的部分说:

pdf 格式只是一个画布,其中 文字和图形放置不 任何结构信息。像这样 中没有任何“iText-objects” PDF 文件。在每一页都会有 可能是一些“字符串”,但是 你无法重建一个短语或一个 使用这些字符串的段落。那里 大概是画了几条线, 但您无法检索 Table-object 基于这些线。简而言之: 解析 PDF 文件的内容是 iText 不可能。发布您的 新闻组上的问题 news://comp.text.pdf 也许你 会从人们那里得到一些答案 已经构建了可以解析 PDF 的工具 并提取其中的一些内容,但是 不要期望工具会执行 防弹转换为结构化 文本。

【讨论】:

  • 现在已经 5 年了。现在有什么解决方案可以从 iTextSharp 读取表格内容吗?任何其他图书馆也可以。
【解决方案2】:

我还需要从 PDF 中读取数据。我最终做的是将 PDF 转换为文本,然后对结果进行字符串解析以获取数据。

在我的场景中,我想获取表格中的数据并将它们转换为 Excel。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2011-03-22
    • 2013-03-18
    • 1970-01-01
    相关资源
    最近更新 更多