【发布时间】:2013-09-17 10:55:49
【问题描述】:
我的问题如下:我想从使用 JSoup 从网站下载的 html 文件中提取一个表格,并将其作为 csv 文件返回。 (数据为历史股价)。
这里是网站:http://www.finanzen.ch/kurse/historisch/Actelion/VIRTX/12.6.2013_17.9.2013
它是德语的,所以我希望这没问题。我想提取包含所有数字的表格。
到目前为止,我得到了以下代码:
Document doc = Jsoup.connect("http://www.finanzen.ch/kurse/historisch/Actelion/VIRTX/12.6.2013_17.9.2013").get();
for (Element table : doc.select("table.Historische Kurse Actelion Ltd.*")) {
for (Element row : table.select("tr")) {
Elements tds = row.select("td");
if (tds.size() > 6) {
System.out.println(tds.get(0).text() + ":" + tds.get(1).text());
}
}
}
我从另一篇 StackOverflow 文章中获得此代码。问题是我对 JSoup 一无所知,而且我对 Java 编程还很陌生。非常感谢您的帮助。
【问题讨论】:
-
Apache Commons CSV 库用于生成(和解析)逗号分隔值 (CSV) 和制表符分隔的文件。本月(2014-11)刚刚发布 1.1 版。
标签: html web-scraping jsoup export-to-csv