【发布时间】:2015-02-24 21:52:30
【问题描述】:
我有一张这样的表格,我想解析它以获取 row.id 的数据代码值以及表格的第二列和第三列。
<table>
<tr class="id" data-code="100">
<td></td>
<td>18</td>
<td class="name">John</td>
<tr/>
<tr class="id" data-code="200">
<td></td>
<td>21</td>
<td class="name">Mark</td>
<tr/>
</table>
我想打印出来。
100, 18, John
200, 21, Mark
我已经尝试了这个帖子的以下建议,但它没有选择任何东西how to parse a table from HTML using jsoup
URL url = new URL("http://www.myurl.com");
Document doc = Jsoup.parse(url, 3000);
Element tables = doc.select("table[class=id]");
for(Element table : tables)
{
System.out.println(table.toString());
}
编辑:也尝试使用 Jsoup.connect() 而不是 parse()
Document doc = null;
try
{
doc = Jsoup.connect("http://www.myurl.com").get();
}
catch (IOException e)
{
e.printStackTrace();
}
【问题讨论】:
-
表没有类“id”...?试试 tr[class=id]
-
它不起作用,我试过
doc.select("table tr.id")和"table tr[class=id]") -
在这里工作正常...错误可能在前两行... println(doc) 输出什么?
-
它不为我打印任何东西
-
将链接放入浏览器时是否显示任何内容?
标签: java html-parsing jsoup