【问题标题】:How to replace a section of a string in document with another string while parsing a document解析文档时如何用另一个字符串替换文档中字符串的一部分
【发布时间】:2020-01-11 08:09:51
【问题描述】:

我有一个已解析的 PDF 文档,我使用 java 中的库对其进行了解析。 问题是文档中的表格没有正确解析,它被解析为文本(逐行)。所以我在 Python 中使用了一个名为 Camelot 的库,它为我提供了解析后的表格格式,然后我将其发送给了 java。我需要用来自 Camelot 的表格替换 PDF 解析的表格,并保持其余的完整。一个文档中有多个表,因此解析后的表以字符串列表的形式返回,每个索引给出每个表的解析值。

boundaryEND 标签表示附加的 Camelot 输出图像中每个表格的结尾。

我尝试通过调用allmatch() 方法来使用流,但由于allmatch() 给出了boolean() 值(仅指示字符串是否匹配而不给出元素本身),因此无法替换该部分。@987654321 @

Java parsed pdf

【问题讨论】:

    标签: java python spring string pdf


    【解决方案1】:

    这可以通过使用自定义收集器的 Stream API 来完成。检查此链接:Split a list into sublists based on a condition with Stream api

    【讨论】:

    • 这行不通,因为它拆分了一个列表,我得到了两个列表。
    猜你喜欢
    • 1970-01-01
    • 2022-12-28
    • 1970-01-01
    • 2011-03-25
    • 2019-09-26
    • 2011-08-10
    相关资源
    最近更新 更多