【问题标题】:Parsing PDF to Excel using C#使用 C# 将 PDF 解析为 Excel
【发布时间】:2010-11-07 13:41:17
【问题描述】:

我有一个 PDF 文件,其中包含例如员工表(empID、empName、Title)。我想将这些 pdf 文件解析为 excel 并将 Excel 中的表格解析为我的代码中的数据表。

【问题讨论】:

  • 停止要求完全陌生的人快速回复。对来说事情很紧急的事实对我们来说并不如此。
  • 我尝试使用 abcpdf.net 解析 pdf,它给了我将 pdf 转换为文本文件但非结构化的转换,因为我的 pdf 文件包含多个表格,然后我想到了转换 pdf到 excel 文件,然后在我的代码中处理 excel 文件
  • 您能否发布一个您尝试从中提取的 PDF 示例,然后我们可以为您提供一些额外的线索?

标签: c# excel pdf


【解决方案1】:

如果您的文件是使用结构化内容创建的,则可以将所有数据提取为 XML 文件,然后将 XML 导入 Excel。

否则,您几乎会留下一堆文本块,并且您可能无能为力。

有关更多信息,请查看 JPedal 博客中关于 PDF Text 的精彩文章。

【讨论】:

  • 不幸的是,它是非结构化 pdf,我无法将其转换为 xml
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2015-05-31
  • 1970-01-01
  • 2017-10-23
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多