【发布时间】:2020-01-11 08:09:51
【问题描述】:
我有一个已解析的 PDF 文档,我使用 java 中的库对其进行了解析。 问题是文档中的表格没有正确解析,它被解析为文本(逐行)。所以我在 Python 中使用了一个名为 Camelot 的库,它为我提供了解析后的表格格式,然后我将其发送给了 java。我需要用来自 Camelot 的表格替换 PDF 解析的表格,并保持其余的完整。一个文档中有多个表,因此解析后的表以字符串列表的形式返回,每个索引给出每个表的解析值。
boundaryEND 标签表示附加的 Camelot 输出图像中每个表格的结尾。
我尝试通过调用allmatch() 方法来使用流,但由于allmatch() 给出了boolean() 值(仅指示字符串是否匹配而不给出元素本身),因此无法替换该部分。@987654321 @
【问题讨论】:
标签: java python spring string pdf