【问题标题】:How to get content of div ( from external url) without loading the whole website如何在不加载整个网站的情况下获取 div 的内容(来自外部 url)
【发布时间】:2015-02-26 09:42:15
【问题描述】:

我正在尝试从外部 url 获取 div 的内容,但我不想加载整个网站。因为我必须从许多网站加载大量数据,而且速度必须非常快......

提前谢谢你!

【问题讨论】:

  • 到目前为止你尝试过什么? - 不要指望我们为你做所有的脚部工作。
  • 嗯,有不同的方法可以从外部 url 获取内容,(比如文件获取内容)但我找不到只加载一个 div 的方法
  • 尝试一些 php 解析器,例如 PHP Simple HTML DOM Parser

标签: php jquery html curl file-get-contents


【解决方案1】:

你也可以用 php 来做

<?php 
     $dom = new DOMDocument;
     libxml_use_internal_errors(true);  //hides errors from invalid tags
     $dom->loadHTMLFile('http://www.w3schools.com/php/default.asp');
     $DOMxpath = new DOMXPath($dom);
     $DivContent = $DOMxpath->query("//a[@class='menu_default']");
     var_dump($DivContent->item(0)->textContent);

【讨论】:

    【解决方案2】:

    检查 jQuery api 中的 .load() 函数。 示例:

    $( "#result" ).load( "test.html #container" );
    

    【讨论】:

    • 我尝试了 API 页面中的示例,但它不适用于外部 URL,例如:&lt;ol id="new-projects"&gt;&lt;/ol&gt; &lt;script&gt; $( "#new-projects" ).load( "http://api.jquery.com/resources/load.html #projects li" ); &lt;/script&gt;
    • 您在尝试时遇到的错误是什么?也许你有原点错误。另外,如果您想尝试使用 php 或 c# ,可以使用网络爬虫库,例如 HtmlAgilityPack
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2014-09-17
    • 2011-09-13
    • 2013-11-21
    • 1970-01-01
    相关资源
    最近更新 更多