【问题标题】:How to parse HTMLDocument using java7's org.w3c.dom.html package instead of Jsoup?如何使用 java7 的 org.w3c.dom.html 包而不是 Jsoup 来解析 HTMLDocument?
【发布时间】:2013-07-05 11:32:26
【问题描述】:

在我的项目中,我使用 jsoup 来解析 html 文档并处理它们,但现在我知道 java 7 有 w3c org.w3c.dom.html 可用于处理 html 文档,但没有教程或其他帮助内容可用,所以请帮助我找到这个 jsoup 代码的替代品

    File in = new File("index.html");
    Document doc = Jsoup.parse(in, null);
    Element form = doc.select("form").first();
    Elements in=doc.getElementsByTag("input");
    for(Element el:in){
        el.attr("value", "23");
    }

Jsoup 是我项目中唯一的外部包,所以我想用 java7 的现有功能替换它。

【问题讨论】:

    标签: java html-parsing jsoup w3c


    【解决方案1】:

    JSoup 很棒 - 你为什么要替换它?

    编辑:

    也许这会有所帮助: http://www.ibm.com/developerworks/library/x-wkdom/index.html

    【讨论】:

    • 这是我的大学项目,我想避免在其中使用任何外部库,这就是为什么我试图用上面的代码对 w3c org.w3c.dom.html HTMLDocument 做同样的事情,我只需要备用代码,因为在互联网上我找不到 w3c 包的代码。
    • 该链接没有帮助,因为他们在那里使用了 // Docuverse imports import com.docuverse.dom.DOM;导入 com.docuverse.dom.html.HTMLFactory;这也是外部库
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2012-04-10
    • 1970-01-01
    • 2013-02-17
    • 2014-02-06
    • 2018-11-19
    • 1970-01-01
    • 2015-10-14
    相关资源
    最近更新 更多