【问题标题】:Grab content from another website [duplicate]从另一个网站抓取内容[重复]
【发布时间】:2011-03-12 11:10:16
【问题描述】:

可能重复:
How to parse and process HTML/XML with PHP?

我想抓取网站下面代码中的任何内容。

<table class="eventResults byEvent vevent"></table>

我怎样才能做到这一点? 谢谢

【问题讨论】:

  • 解释一下“抢”的目的,因为它可以帮助我们回答问题
  • 抓取 = 抓取 = 读取字符串

标签: php


【解决方案1】:

如果您想grab HTML from a site,您将需要使用DOM ParserPHP has several XML processing packages 为您提供帮助,无论是 DOMSimpleXML 还是 XMLReader。 SO 经常建议的替代方案是SimpleHtmlDom

由于表中的一个类是vevent,表中的内容可能是hCalender microformat(不看内容就无法确定)。如果是这样,您还可以使用microformat 解析器,最好是Transformr,以节省您手动解析事件数据的工作。

【讨论】:

    【解决方案2】:

    您可以为此使用file_get_contents 函数或curl 扩展。

    【讨论】:

    • 是的,我正在尝试,但无法正常工作。
    • @Victor,真不幸..?
    • @Victor:你也应该发布你正在尝试的代码。
    【解决方案3】:

    首先从该网站获取整个页面的内容作为字符串,然后使用正则表达式提取表格标签内的子字符串。

    【讨论】:

    • 可以使用 cURL 获取目标网站的整个页面。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-01-07
    • 2020-03-09
    • 2015-05-02
    相关资源
    最近更新 更多