【发布时间】:2019-08-14 16:03:11
【问题描述】:
我正在尝试将 html 数据表拉入单个数据框中,并且我正在寻找一个优雅的解决方案。有 255 个表,并且 url 因两个变量而异:Year 和 Aldermanic District。我知道一定有办法使用 for 循环或其他东西,但我很难过。
我已经通过使用单独的代码行读取每个表成功导入了数据,但这会导致每个表都有一行,同样有 255 个表。
library(XML)
data <- bind_rows(readHTMLTable("http://assessments.milwaukee.gov/SalesData/2018_RVS_Dist14.htm", skip.rows=1),
readHTMLTable("http://assessments.milwaukee.gov/SalesData/2017_RVS_Dist14.htm", skip.rows=1),
readHTMLTable("http://assessments.milwaukee.gov/SalesData/2016_RVS_Dist14.htm", skip.rows=1),
readHTMLTable("http://assessments.milwaukee.gov/SalesData/2015_RVS_Dist14.htm", skip.rows=1),
理想情况下,我可以使用for 循环或其他东西,这样我就不必为每个表手动编写readHTMLTable 函数。
【问题讨论】:
标签: r web-scraping xml-parsing