【问题标题】:Problem regarding highlighting text in pdf document python关于在pdf文档python中突出显示文本的问题
【发布时间】:2019-11-07 23:00:32
【问题描述】:

我正在尝试编写一个 python 脚本,该脚本将自动执行在 pdf 中查找文本并突出显示的过程

我正在使用 python 的 pymupdf 模块。它适用于一些pdf。但是,对于目标 pdf(组件和属性表的绘图),它会将输出保存为没有数据和一些空白突出显示的空白 pdf。

import fitz

doc=fitz.open("c5.pdf")

page = doc[0]

text = "a"

text_instances = page.searchFor(text)

for inst in text_instances:
    highlight = page.addHighlightAnnot(inst)


doc.save("out.pdf", garbage=4, deflate=True, clean=True)

【问题讨论】:

    标签: python pdf annotations pymupdf


    【解决方案1】:

    您的 PDF 可能包含出现类似于文本但又是其他内容的元素。它们可能只是某种类型的图形或图像。 在那种情况下,文本搜索当然找不到任何东西。

    请在我的 PyMuPDF 存储库上提交一个问题,并附上一些示例 PDF,以便我对此进行调查。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2011-09-04
      • 2017-03-10
      • 2011-07-02
      • 2018-08-29
      • 1970-01-01
      • 2012-12-24
      • 1970-01-01
      • 2013-10-17
      相关资源
      最近更新 更多