【问题标题】:how to get values using simple html parser or something else如何使用简单的 html 解析器或其他东西获取值
【发布时间】:2013-12-11 06:16:39
【问题描述】:

这可能是重复的。 但我想知道如何使用简单的 HTML DOM Parser 或其他在段落末尾有更多按钮(也许最好称为链接)的东西从段落中获取文本。 例如 This is test string and I want to get this data but don't know how to [more...]

实际的文字是 This is test string and I want to get this data but don't know how to get it Please anybody help me.

所以任何人都可以解释我怎样才能得到这个完整的段落。 提前致谢

【问题讨论】:

  • 您是否需要检查一些您知道要搜索的文本,或者您通常需要搜索您不知道的文本?无论如何,我很确定您需要使用us2.php.net/preg_match regexp。
  • 我想了解 GE 段落和更多类似的公司
  • @mcuadros 。我目前正在使用 PHP 获取其他文件,所以我不知道它是否是 js Q(PHP 顺利完成此操作以获取其他部分)

标签: javascript php html simple-html-dom


【解决方案1】:

此网页的所有源代码都使用 JavaScript 重新格式化和重新排列,并且由于 Simple HTML DOM 不处理 JS,因此您必须处理原始代码(在 JS 更改之前),您可以检查使用 ctrl+U... 然后,基于它,您可以正确编写解析器...

他是回答您问题的有效代码:

// includes Simple HTML DOM Parser
include "simple_html_dom.php";

$url = 'http://www.linkedin.com/company/1015?trk=vsrp_companies_res_name&trkInfo=VSRPsearchId%3A2646459271384809644652%2CVSRPtargetId%3A1015%2CVSRPcmpt%3Aprimary#';

//Create a DOM object
$html = new simple_html_dom();
// Load HTML from a string
$html->load_file($url);

// Get the node having "text-logo" class
$div = $html->find('div.text-logo', 0);

echo $div;
echo "<hr>";

// Get logo node
$logo = $html->find('img.logo', 0);

echo $logo->alt ." => ". $logo->src;

// Clear dom object
$html->clear(); 
unset($html);

Working DEMO

【讨论】:

  • @Enissay:你能告诉我,我怎样才能从同一个地址获得徽标名称和徽标,谢谢
  • :) 谢谢 man..this 会给我 logo src 但你能给我一个例子,我如何抓取图像并将其存储在本地机器上??
  • 这很容易,因为你有图片的网址......你会在这里和谷歌上找到很多答案......如果你失败了,请随时开始一个新问题,所以我们不要不要超载这个:)
  • 好的,再次感谢。 BUt 目前我面临这个问题,无法打开流功能 file_put_contents() :(
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2023-03-30
  • 2011-03-22
  • 2016-09-12
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多