【发布时间】:2018-03-17 04:13:51
【问题描述】:
我有一个 pdf 文件的字节数组,想从文件中取出文本。我下面的代码有效,但我需要先创建一个实际文件。你知道更好的方法,所以我不必先创建这个文件吗?
try {
File temp = File.createTempFile("temp-pdf", ".tmp");
OutputStream out = new FileOutputStream(temp);
out.write(Base64.decodeBase64(testObject.getPdfAsDoc().getContent()));
out.close();
PDDocument document = PDDocument.load(temp);
PDFTextStripper pdfStripper = new PDFTextStripper();
String text = pdfStripper.getText(document);
log.info(text);
} catch(IOException e){
}
【问题讨论】: