【发布时间】:2020-08-31 12:52:27
【问题描述】:
我想 scrape 页面,但在那些页面中,它们提供了如下所示的值,但我使用 elementby 标记名获取元素,我不能怀疑强标签旁边的引号值,任何人都可以帮忙我。
<br>
<br>
<strong>Location</strong>
"India,calculata
"
<br>
<br>
【问题讨论】:
-
请不要只求我们为您解决问题。向我们展示您是如何尝试自己解决问题的,然后向我们确切展示结果是什么,并告诉我们您为什么觉得它不起作用。向我们明确解释什么不起作用并提供a Minimal, Complete, and Verifiable example。阅读How to Ask 一个好问题。请务必take the tour 并阅读this。
-
我尝试使用 php 中的 dom 文档的 curl 函数,我尝试了示例代码,如下所示 $table = $dom->getElementById('JobDesc3606816961'); foreach($table->getElementsByTagName('strong') as $tablelist) {$tablelist->nodeValues} 以获得强标签值的响应,除了我需要下一个强标签值示例,我使用强标签来获取位置名称,但我需要印度的值和计算
-
如果你想要 India,calculata,抓住包裹它的父元素,然后从里面移除垃圾,你需要做一些调整,因为它不是一个很好的结构化 DOM ..即:3v4l.org/3KV2l
-
好的,谢谢您的回复。nodevalues 包含所有值,如何拆分国家、城市和所有$table = $dom->getElementById('JobDesc3606816961') foreach($table-> getElementsByTagName('div') as $tablelist) { echo $tablelist->textContent."\n";} 我得到国家的总体价值:印度城市:德里
标签: php dom web-scraping element