help(data) 的详细信息部分提供了一些很好的信息。以下是基础知识,以 plyr 包为例。首先,让我们看看 data() 提供的内容。
names(data())
#[1] "title" "header" "results" "footer"
对这些元素的进一步调查将揭示其中的内容。接下来,我们可以使用data() 中的参数,然后对结果列表进行子集化,以查找包中数据集的名称。
d <- data(package = "plyr")
## names of data sets in the package
d$results[, "Item"]
# [1] "baseball" "ozone"
## assign it to use later
nm <- d$results[, "Item"]
## call the promised data
data(list = nm, package = "plyr")
## get the dimensions of each data set
lapply(mget(nm), dim)
# $baseball
# [1] 21699 22
#
# $ozone
# [1] 24 24 72
编辑/更新:如果您希望在所有已安装的包中查找数据集的名称,您可以使用以下命令。 .packages(TRUE) 提供库位置路径lib.loc 中可用的所有包。由于 base 和 stats 包中的数据集已移至 datasets 包中,因此我们需要将它们取出来setdiff()。
## names of all packages sans base and stats
pkgs <- setdiff(.packages(TRUE), c("base", "stats"))
## get the names of all the data sets
dsets <- data(package = pkgs)$result[, "Item"]
## look at the first few in our result
head(dsets)
# [1] "AirPassengers" "BJsales" "BJsales.lead (BJsales)"
# [4] "BOD" "CO2" "ChickWeight"