【发布时间】:2014-04-08 12:19:02
【问题描述】:
我正在尝试抓取此网页,但是当我回显 img 脚本时。是返回 403 Forbidden-nginx/1.4.3
有人可以帮忙吗?
这是我的代码:
$url = '1cak.com/trending-0-&ajax_seek=1396912798&seek_max_time=1396921201';
$ch = curl_init($url);
curl_setopt($ch, CURLOPT_RETURNTRANSFER, true);
curl_setopt($ch, CURLOPT_HEADER, 0);
curl_setopt($ch, CURLOPT_TIMEOUT, 15);
curl_setopt($ch,CURLOPT_USERAGENT, 'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.17 (KHTML, like Gecko) Chrome/24.0.1312.52 Safari/537.17)');
curl_setopt($ch, CURLOPT_FRESH_CONNECT, TRUE);
$curl_scraped_page = curl_exec($ch);
$html = new simple_html_dom();
$html->load($curl_scraped_page);
foreach($html->find('div[style="border-bottom:1px solid #ccc;padding-bottom:10px;padding-top:10px"]') as $item){
echo $item->find('img',0)->src ."<br/>";
echo "<img src=".$item->find('img',0)->src."><br/>";
}
【问题讨论】:
-
也许有人不希望你这样做。 ;)
标签: php curl web-scraping simple-html-dom