【发布时间】:2022-06-23 17:21:55
【问题描述】:
我正在尝试在 Wikidata 页面上抓取整个“更多语言”表,例如https://www.wikidata.org/wiki/Q3044
我在 R 中尝试了 2 种方法:
library(rvest)
url <- "https://www.wikidata.org/wiki/Q3044"
pg <- url %>% read_html
pg <- pg %>%
html_nodes(".wikibase-entitytermsforlanguagelistview") %>%
html_table()
table <- pg[[1]]
但这仅返回英文部分(1 行)。
我也试过了:
library(tidywikidatar)
tw_get_label(id = c("Q3044"),language = "nl")
但这只会返回一个标签。但是,我想要 Wikidata 上的所有“也称为”类别。
任何帮助将不胜感激!
【问题讨论】: