【发布时间】:2021-06-30 05:23:01
【问题描述】:
我正在尝试从 pewdiepie 频道获取所有视频链接。我写了以下代码,它没有显示任何错误,但它没有抓取链接。
代码如下:
import scrapy
from scrapy.crawler import CrawlerProcess
class PewSpider(scrapy.Spider):
name = "pew_spider"
def start_request(self):
urls = ['https://www.youtube.com/user/PewDiePie/videos']
for url in urls:
yield scrapy.Request(url=url, callback=self.parser)
def parser(self, response):
links = response.css('div#contents > a#thumbnail::attr(href)')
filepath = "./Desktop/pew.csv"
with open(filepath, 'w') as f:
f.writelines( [link + '/n' for link in links])
process = CrawlerProcess()
process.crawl(PewSpider)
process.start()
【问题讨论】:
标签: python-3.x web-scraping scrapy web-crawler