【问题标题】:fetching webpage through java通过java获取网页
【发布时间】:2011-08-15 17:18:11
【问题描述】:

我需要获取给定的网页,然后将 HTML 标记转换为 XML 标记,并从这些 XML 标记中构建一棵树。我怎样才能做到这一点 ??请告诉我一些基于这些的好的链接或教程,顺便说一句,我使用的是 java 语言。

谢谢。

【问题讨论】:

  • 您是否尝试过编写任何代码? HTML 通常包含无效的分层 XML 内容。这不会是一件容易的事。

标签: java tree html-parsing webpage xml-parsing


【解决方案1】:

HttpClient 获取数据。 HtmlCleaner 将其转换为 XML。

两者都有教程。

【讨论】:

    【解决方案2】:
    猜你喜欢
    • 1970-01-01
    • 2011-06-12
    • 2011-10-18
    • 1970-01-01
    • 2020-11-02
    • 2015-04-05
    • 1970-01-01
    • 1970-01-01
    • 2014-10-03
    相关资源
    最近更新 更多