【发布时间】:2011-10-07 17:48:35
【问题描述】:
我希望以编程方式仅从 pdf 文档中获取字数。
我查看了 PDFSharp,但它对于我想做的事情来说非常庞大。我无权访问服务器,所以我无法安装 acrobat 来访问他们的 api 或任何东西。我愿意在 iTextSharp 或其他工具中这样做。
【问题讨论】:
-
您在寻找什么样的成功率?过去我遇到过从扫描图像创建 pdf 的问题,这在某些时候基本上需要 OCR,这有它自己的一系列问题
-
成功率并不重要...这是针对对翻译报价进行最佳猜测的翻译网站。 ToU 上到处都是白话,说报价不是合同。此外,通常在该行业中,图像不被认为是“可翻译的”(这是一个非常不宽容的行业)。 :)
标签: c# pdf itextsharp