【问题标题】:How to extract sub elements and text from XML in Java如何在 Java 中从 XML 中提取子元素和文本
【发布时间】:2013-02-13 23:55:23
【问题描述】:

我有以下 XML,我想使用 Java 和可能的 XPath 提取 en-note 元素下的所有内容,包括文本和子元素?

源 XML:

<en-note style="word-wrap: break-word; -webkit-nbsp-mode: space; -webkit-line-break: after-white-space;">
  A little test note…
  <div><br/></div>
  <div>
    <ul>
      <li>blah</li>
    </ul>
  </div>
</en-note>

我要提取的内容:

  A little test note…
  <div><br/></div>
  <div>
    <ul>
      <li>blah</li>
    </ul>
  </div>

谢谢,

【问题讨论】:

标签: java xml xpath xml-parsing


【解决方案1】:

你需要和 String.indexOf 和 String.substring() 成为最好的朋友

我可以给你最好的答案是告诉你用 indexOf 找到一个点,然后用子字符串解析它

【讨论】:

  • 使用现有的库会更好。如果 XML 中早先出现了另一个元素并在其内容中包含文本 en-note 怎么办?
  • 您创建了第二个名为 temp 的字符串。您在其中加载所有 XML。然后你从上到下解析它,直到你得到你想要的。这是相当标准的程序。
  • IndexOf 抓取您所要求的第一个实例,因此您可以线性地分解 XML,直到您拥有所需的内容
  • 好的...没关系。似乎仍然有更可靠的库。
  • 正则表达式本身没有定义任何限制,所以它必须是您正在使用的匹配器,可能会遇到缓冲区问题...我现在将使用字符串解析,谢谢您帮助。
猜你喜欢
  • 2012-12-03
  • 2021-05-03
  • 1970-01-01
  • 1970-01-01
  • 2013-08-24
  • 1970-01-01
  • 1970-01-01
  • 2013-11-06
  • 2020-12-15
相关资源
最近更新 更多