【发布时间】:2021-01-01 18:54:18
【问题描述】:
我正在尝试读取某个目录中的一些 pdf,并将其页面的图像输出到不同的目录中。
(我正在寻求了解这段代码的工作原理,我希望有一种更简洁的方法来为我的图像文件指定输出目录。)
我所做的工作,但我认为它只是在我的保存目录和我的 pdf 目录之间来回跳动。
这感觉不是一个干净的方法。有没有更好的选择,可以保留现有代码并完成我添加的行的作用?
import os
from pdf2image import convert_from_path
pdf_dir = r"mydirectorypathwithPDFs"
save_dir = 'mydirectorypathforimages'
os.chdir(pdf_dir)
for pdf_file in os.listdir(pdf_dir):
os.chdir(pdf_dir) #I added this, change back to the pdf directory
if pdf_file.endswith(".pdf"):
pages = convert_from_path(pdf_file, 300)
pdf_file = pdf_file[:-4]
for page in pages:
os.chdir(save_dir) #I added this, change to the save directory
page.save("%s-page%d.jpg" % (pdf_file,pages.index(page)), "JPEG")
我稍微修改的代码是由@photek1944 创建的,在这里可以找到:https://stackoverflow.com/a/53463015/10216912
【问题讨论】:
-
我认为这没有问题。不干净是什么意思?如果你不想切换目录,那么你可以保存到绝对路径,或者使用相对路径,那么你不需要任何os命令
-
嗨,谢谢 Max,是的,我想这就是我想要提前指定输入和输出路径
-
我不明白你为什么要同时使用
chdir(pdf_dir)和listdir(pdf_dir)。如果您使用chdir(pdf_dir),那么您可以使用listdir()而不使用参数。或者如果你使用listdir(pdf_dir),那么你就不需要chdir(pdf_dir) -
如果您不想反复来回更改工作目录,请使用绝对路径而不是相对路径。
-
谢谢大家,有人能告诉我如何使用绝对路径吗?我认为这是我的挂断,我只是不知道如何有效地做到这一点。
标签: python pdf directory chdir