【发布时间】:2023-02-24 16:42:02
【问题描述】:
我有一系列包含多个工作表的 xlsx 文件(每个文件 > 200mb)。只有第一张文件包含介绍,例如:
| This table is designed for balabala etc... | balabala |
|---|---|
| Reference Key | date |
| 1 | 01/01/1999 |
每个文件的介绍行数不一样,但所有数据集都以Reference Key变量开头。
将来自同一文件的工作表合并到一个 xlsx 文件中时,是否可以避免读取整个数据集并删除介绍?
【问题讨论】:
-
readxl::read_excel中有跳过选项 -
但是
readxl::read_excel中的跳过选项也会跳过每张纸中的n行,这不是我想要的 -
此外,readxl::read_excel 的速度对我来说仍然太慢,尤其是与 fread 相比...
-
fread中的skip="string"选项呢? -
fread不支持读取xlsx格式。
标签: r excel data.table tidyverse apache-arrow