【问题标题】:Extracting Headings and paragraphs separately from xml files in Java从 Java 中的 xml 文件中分别提取标题和段落
【发布时间】:2015-07-24 08:36:55
【问题描述】:

我首先将 xml 文件转换为字符串,然后尝试在文件中搜索特定标签。但是,字符串文件非常长(大约 15 亿个字符),因此搜索通常需要几分钟才能计算出有多少标题。有一个更好的方法吗?或者是一套提取数据的方法。

【问题讨论】:

  • 为什么要将 xml 文件转换为字符串...您可以使用任何 SAX(或)DOM 解析器从 xml 文件中读取标题标签

标签: java html xml extraction


【解决方案1】:

不要将 XML 转换为字符串。

使用 XPATH(XML 中标签的地址)解析 XML 并提取所需数据 详情请参考this site

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-04-13
    • 2016-10-02
    • 1970-01-01
    • 2011-07-15
    相关资源
    最近更新 更多