【问题标题】:How to correctly redact PDF file using Python?如何使用 Python 正确编辑 PDF 文件?
【发布时间】:2020-12-19 06:52:43
【问题描述】:

我正在尝试使用 python 编辑 PDF 文件,尝试了许多库,如 pdfrw、pdfminner 甚至 pyPDF2,但它们都没有帮助我正确编辑 PDF 的内容,因为事实证明该库正在使用图层合并 PDF 及其放置我在原始图层顶部的编辑框。我什至可以选择我的编辑框下方的内容(参见参考图片)。我试图将它们展平,它确实对我有帮助,但事实证明我什至无法选择或复制任何内容或搜索任何部分。

PDF 问题

所以请建议我如何正确编辑 PDF 中的内容。

这就是我想要实现的:已编辑的部分不再可访问,但文件的其余部分是

【问题讨论】:

  • 您需要找到构成要编辑的信息的 PDF 元素并更改它们,而不仅仅是将元素粘贴到顶部。
  • 你能解释一下吗

标签: python pdf redaction


【解决方案1】:

最后我能够正确地编辑内容,您所要做的就是获取 PDF 数据流并找出对象“TJ”、“BT”和“ET”,然后将这些文本替换为 Null 或您需要替换的单词。之后你也可以在它上面创建一个盒子

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2012-04-23
    • 2017-03-12
    • 1970-01-01
    • 2010-09-09
    • 2019-11-17
    • 2015-10-31
    • 2011-06-03
    相关资源
    最近更新 更多