【发布时间】:2013-04-17 11:08:47
【问题描述】:
我正在尝试构建一个可以读取 PDF 文件的应用程序。我使用本指南:
http://www.codeproject.com/Articles/14170/Extract-Text-from-PDF-in-C-100-NET
但不明白“文件”的含义是您计算机上的整个网址。因为当我尝试它时,它说它的格式错误。
String file = "C:/project/test2.pdf";
// create an instance of the pdfparser class
PDFParser pdfParser = new PDFParser();
// extract the text
String result = pdfParser.ExtractText(file);
错误信息:
错误 1 方法 'ExtractText' 没有重载需要 1 个参数
【问题讨论】:
-
您在路径中的
C之后错过了:。不过,这与您的错误消息无关。 -
没有帮助,但感谢您的反馈
-
嗯,消息告诉您
ExtractText方法需要多个参数。 Intellisense 说您需要提供哪些参数? -
public bool ExtractText(string inFileName, string outFileName)
-
您可能希望遵循 Ria 的回答并使用 iTextSharp 中已内置的 PDF 文本解析功能(如果您使用的是当前版本),因为 codeproject 解决方案非常幼稚并忽略了大部分 PDF规范,参见this answer 从您的
PDFParser的问题中讨论“方法1”。
标签: c# itextsharp pdftotext