【发布时间】:2019-09-26 02:46:24
【问题描述】:
我找不到合适的 JavaScript 解决方案来在 Adobe Acrobat 中创建将文本提取到 .txt 文件中的序列;基于某些标准。
我有 500 多份包含图片和财务数据的 pdf。我需要从这些页面中提取特定值。包括:支票号码、支票日期、支票金额等值。
我尝试了以下示例: https://www.evermap.com/javascript.asp#Title:%20Extract%20ISBN%20numbers
我什至用 ISBN 编号创建了一个 PDF,但它不起作用。
在我的 PDF 中,我有以下数据:
生产日期:2019/01/04
帐号:69447885236
CheckAmt:157.52
序列号:8574
MflmSeqNum: 268245062738
生产日期:2019/01/14
帐号:69447885236
CheckAmt:2,415.36
序列号:8570
MflmSeqNum:268545187745
我需要以分隔格式将值提取到文本文件(或 Excel 表)中。预期输出如下:
2019 年 1 月 14 日; 2,415.36; 8570
2019/01/04; 157.52; 8574
【问题讨论】:
标签: javascript ocr acrobat pdf.js