【发布时间】:2021-03-05 00:22:42
【问题描述】:
我正在尝试使用pdfminer.high_level.extract_text() 将 PDF 转换为纯文本。我不断收到此错误消息:
File "/Users/ian/Documents/Resume Selector Project/resumeBackend.py", line 5, in digestResume
text = pdfminer.high_level.extract_text
AttributeError: module 'pdfminer' has no attribute 'high_level'
起初,我认为这可能是我的模块未在系统范围内安装的问题,但我相信我已经通过在我的项目所在的同一目录中运行 pdf2txt.py 消除了这个可能的原因。
我将附上我的代码以便于解决这个问题。
import pdfminer
print(pdfminer.__version__)
res = '~/Documents/Personal/Employment/Resumes/Resume\ 11/03/2020'
def digestResume(resume): #resume is a pdf file (as str)
text = pdfminer.high_level.extract_text(resume)
print(text)
digestResume(res)
【问题讨论】:
标签: python python-3.x module pdfminer