【发布时间】:2016-02-20 19:48:17
【问题描述】:
我试图在我的 html 文档中获取两个 css 类标签之间的数据。
这里是例子。
<p class="heading10">text text</p>
<p>text text text</p>
<p>text text text</p>
<p class="heading11">text text</p>
<p></p>
<p></p>
不知道怎么抢
该类标题10 和标题11 之间的数据。
我试过//p[@class="heading10"]//following-sibling::p],它会抓取类标题10之后的所有<p>。
【问题讨论】:
-
我怀疑这是否可以通过 xpath 查询实现......但不要在那里引用我的话。但是,您可以抓住它上面的节点并循环遍历它的子节点 - 在类标题 10 的第一个实例之后将每个元素存储到一个数组中,并在找到类标题 11 时停止。然后,您可以根据需要使用新数组来解析 HTML。
-
Mikel,任何简单的代码。我有点迷路了。thx
-
这就是目前为止。 $pTag1 = $tPageXpath->query('//*[@class="Heading10"]/following-sibling::p');我总共有 5 个元素。现在确定当元素到达标题 11 时如何停止该循环。