【发布时间】:2019-06-13 21:21:09
【问题描述】:
我想从 OCR 数据中提取表格信息,我有原始文本,它是文本。 我尝试了 pytesseract 但找不到实际的实现。
这是一张图片:https://drive.google.com/open?id=1CGJwbmf5snoXvwlQAsRAxIRRixbT_Q8l
我试过这个:https://github.com/WZBSocialScienceCenter/pdftabextract
这个方法根本不适合我。
我想从 OCR 数据中获得此表的表格结构,以供我进一步处理。
【问题讨论】: