【发布时间】:2011-05-12 04:58:46
【问题描述】:
我有 5 个 PDF 文件,每个文件都有指向另一个 PDF 文件中不同页面的链接。这些文件是大型 PDF 的每个目录(每个大约 1000 页),使手动提取成为可能,但非常痛苦。到目前为止,我已经尝试在 Acrobat Pro 中打开该文件,并且可以右键单击每个链接并查看它指向的页面,但我需要以某种方式提取所有链接。我不反对对链接进行大量的进一步解析,但我似乎无法以任何方式将它们拉出来。我尝试将 Acrobat Pro 中的 PDF 导出为 HTML 或 Word,但两种方法都无法维护链接。
我无能为力,任何帮助都会很棒。我喜欢使用 Python 或其他一系列语言
【问题讨论】:
-
更新:遗憾的是,这些方法都没有奏效。对于那些有类似问题的人,我最终做的是使用带有 Acrobat Pro 的 AutoBookmark 插件并将链接导出到文件,然后解析文件。像魅力一样工作