【发布时间】:2021-08-14 00:19:05
【问题描述】:
我的要求是创建一个流程,其输入将是 PDF/TIF 文件(批量摄取)。提取/分类将由专门的(提取组)完成。一旦我们获得具有置信度的文档,就必须过滤只有自信的词(说 > 95% 的置信度值)并将它们写入文本文件。截至目前,KTA 不支持完整的 OCR 文本,因此必须在自定义 dll 中使用 GetPagePropertyValues() SDK。任何人都处理过类似的要求和是否有更好的方法(自定义代码透视)?
【问题讨论】:
我的要求是创建一个流程,其输入将是 PDF/TIF 文件(批量摄取)。提取/分类将由专门的(提取组)完成。一旦我们获得具有置信度的文档,就必须过滤只有自信的词(说 > 95% 的置信度值)并将它们写入文本文件。截至目前,KTA 不支持完整的 OCR 文本,因此必须在自定义 dll 中使用 GetPagePropertyValues() SDK。任何人都处理过类似的要求和是否有更好的方法(自定义代码透视)?
【问题讨论】:
KTM 支持它,您可以使用 KTM 脚本过滤掉具有所需置信度百分比的定位器结果。使用脚本定位器来处理它。
【讨论】: