【问题标题】:Challanges with Pdf/a file for extraction using Python使用 Python 提取 Pdf/a 文件的挑战
【发布时间】:2020-12-07 10:46:02
【问题描述】:

我们有一些 PDF/A 文件要提取,当我们尝试使用标准 pdf 提取库时,整个页面的程序没有返回任何内容。对于标准 pdf 和重新调整值,相同的程序运行良好。

任何人都可以帮助如何使用 python 库转换它们。

【问题讨论】:

  • 失败了 还不够继续。显示您为进行转换而调用的 Python 代码和您收到的错误消息,以及完整的库存跟踪。
  • 您应该提供更多详细信息:哪个库,哪种 pdf ;纯文本还是扫描/图片?当然还有你的代码。

标签: python text-extraction pypdf2 pdfa


【解决方案1】:

你尝试过 pyPDF2 吗?

import PyPDF2 
pdfFileObj = open('example.pdf', 'rb') 

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2014-09-19
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-05-19
    相关资源
    最近更新 更多