【问题标题】:PHP How to scrape content from this specific URL [closed]PHP如何从这个特定的URL中抓取内容[关闭]
【发布时间】:2016-10-21 18:36:12
【问题描述】:

谁能告诉我他们如何亲自从像这个 URL https://www.wayfair.com/The-Childrens-Factory-48-H-x-24-W-Mirror-CF332-132-GBS1086.html 这样的页面获取产品价格

我已经尝试了好几天没有运气。

感谢您的帮助。

【问题讨论】:

  • 好吧,我会问他们。他们有一个电子邮件地址。尤其是因为无论如何你都需要他们同意你抓取他们的网站。
  • 到目前为止你尝试了什么?发布您的代码!运行时发生了什么?你期望会发生什么?您具体遇到了什么问题?
  • @Robert 我正在使用 Jose 下面发布的相同代码。当我将它放入一个函数并设置 return $all[$pos]; 时,结果它没有返回一个字符串。它返回 1。你知道这是为什么吗?

标签: php web-scraping web-crawler


【解决方案1】:

将下一个代码复制粘贴到 PHP 文件中并在浏览器中运行:

<?php
// ▼ FIRST, GET THE WHOLE HTML FROM THE WEB PAGE.
$all = file_get_contents("https://www.wayfair.com/The-Childrens-Factory-48-H-x-24-W-Mirror-CF332-132-GBS1086.html");
$pos = strpos( $all,"dynamic-sku-price" ); // ◄■■ PRICE TAG.
$pos += 36; // SKIP SOME HTML CHARS.
while ( $all[ $pos ] != chr( 10 ) ) // ◄■■ GET PRICE CHARS UNTIL END OF LINE.
{ echo $all[ $pos ];
  $pos++;
}
?>

【讨论】:

  • 谢谢,非常感谢
【解决方案2】:

下载该页面的html字符串并使用DOM xpath进行解析。

【讨论】:

  • 我尝试了很多次,但什么也得不到。每当我尝试通过 file_get_contents 加载 URL 时,我总是会收到错误
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2022-07-11
  • 2020-06-02
  • 1970-01-01
  • 1970-01-01
  • 2020-08-24
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多