【问题标题】:tabula 'pages' argument not specified, pages='all'tabula 'pages' 参数未指定,pages='all'
【发布时间】:2020-07-22 10:28:14
【问题描述】:

我正在尝试使用表格从 PDF 文件中提取一些数据。 我面临的问题是它只从一页中提取,即使指定了 pages 参数。

不太清楚发生了什么,任何见解将不胜感激! ~

代码:

import tabula

tables = tabula.read_pdf("testfile.pdf", pages='all')
tabula.convert_into("testfile.pdf", "test_file_tables.csv")

谢谢!

【问题讨论】:

  • 可能是无法检测到其他页面中的表格?您是否尝试从您认为 all 不起作用的特定页面中提取。

标签: python pdf tabula


【解决方案1】:

查看文档后,我意识到我忘记在 .convert_into 中指定 pages 参数

正确的代码是:

tables = tabula.read_pdf("testfile.pdf", pages='all')
tabula.convert_into("testfile.pdf", "test_file_tables.csv", pages='all')

【讨论】:

  • 第一行不是必须的
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2022-12-04
  • 1970-01-01
  • 2015-09-06
  • 2020-07-07
  • 2018-09-09
  • 1970-01-01
  • 2021-05-07
相关资源
最近更新 更多