【问题标题】:HTMLCleaner and XPathHTMLCleaner 和 XPath
【发布时间】:2019-09-09 07:47:23
【问题描述】:

HTMLCleaner 是否支持 XPath position() 函数和使用谓词来表示位置?

我的代码如下:

HtmlCleaner htmlCleaner = new HtmlCleaner();
String sourceUrl = "http://jobs.alaska.gov/RR/WARN_notices.htm";
URL url = new URL(sourceUrl);
URLConnection urlConnection = url.openConnection();
TagNode rootTagNode = htmlCleaner.clean(new InputStreamReader(urlConnection.getInputStream()));
String xpathOne = "//table[2]/tbody/tr/td/table/tbody/tr/td/table/tbody/tr[1]/td/div/span/text()";
// String xpathTwo = "//table[2]/tbody/tr/td/table/tbody/tr/td/table/tbody/tr[3]/td/div/span/text()";
Object[] xPathNodes = rootTagNode.evaluateXPath(xpathOne);
// Object[] xPathNodes = rootTagNode.evaluateXPath(xpathTwo);

for(Object object : xPathNodes) {
   System.out.println(object);
}

xPathOne 正确执行并返回带有标题的表格行。 xPathTwo 不返回任何内容,但它应该返回表中的第一行数据。任何帮助将不胜感激。谢谢。

【问题讨论】:

    标签: xpath predicate htmlcleaner


    【解决方案1】:

    我认为那里没有 span 元素,所以也许缩短到 //table[2]/tbody/tr/td/table/tbody/tr/td/table/tbody/tr[3]/td/div/text() 的路径是你想要的。

    【讨论】:

    • 太好了,这是我的疏忽。非常感谢您发现这一点。真的很感激。
    猜你喜欢
    • 2013-09-27
    • 2011-05-28
    • 1970-01-01
    • 2012-12-25
    • 2013-04-13
    • 2013-05-14
    • 2010-11-14
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多