【发布时间】:2020-07-22 10:28:14
【问题描述】:
我正在尝试使用表格从 PDF 文件中提取一些数据。 我面临的问题是它只从一页中提取,即使指定了 pages 参数。
不太清楚发生了什么,任何见解将不胜感激! ~
代码:
import tabula
tables = tabula.read_pdf("testfile.pdf", pages='all')
tabula.convert_into("testfile.pdf", "test_file_tables.csv")
谢谢!
【问题讨论】:
-
可能是无法检测到其他页面中的表格?您是否尝试从您认为
all不起作用的特定页面中提取。