【问题标题】:Filter words as per confidence level根据置信度过滤单词
【发布时间】:2021-08-14 00:19:05
【问题描述】:

我的要求是创建一个流程,其输入将是 PDF/TIF 文件(批量摄取)。提取/分类将由专门的(提取组)完成。一旦我们获得具有置信度的文档,就必须过滤只有自信的词(说 > 95% 的置信度值)并将它们写入文本文件。截至目前,KTA 不支持完整的 OCR 文本,因此必须在自定义 dll 中使用 GetPagePropertyValues() SDK。任何人都处理过类似的要求和是否有更好的方法(自定义代码透视)?

【问题讨论】:

    标签: c# kofax


    【解决方案1】:

    KTM 支持它,您可以使用 KTM 脚本过滤掉具有所需置信度百分比的定位器结果。使用脚本定位器来处理它。

    【讨论】:

    • 感谢您的回复,我们不希望在项目级别这样做。
    猜你喜欢
    • 2012-07-03
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-03-02
    • 2018-06-16
    • 1970-01-01
    • 1970-01-01
    • 2019-10-15
    相关资源
    最近更新 更多