【发布时间】:2011-11-22 17:09:34
【问题描述】:
我的目标是从 PDF 中检索数据,这些数据可能是表格结构到一个 excel 文件中。
将 LocationTextExtractionStrategy 与 iTextSharp 结合使用,我们可以从左到右获取页面内容的纯文本字符串数据。
我怎样才能在
PdfTextExtractor.GetTextFromPage(reader, i, new LocationTextExtractionStrategy())
我可以让文本在结果字符串中保留其坐标。
例如,如果 pdf 中的第一行文本右对齐,则生成的字符串必须包含尾随空格或保持内容右对齐的空格。
请给出一些建议,我可以如何继续实现相同的目标。
【问题讨论】:
标签: excel pdf itextsharp