【发布时间】:2016-09-28 14:10:41
【问题描述】:
这可能是一个重复的问题。我正在尝试运行 Scrapy 蜘蛛,但无法运行。为什么我会收到错误消息“HtmlResponse 没有属性 urljoin”?如果 request_count 为 3 而 response_count 也为 3,那么 Scrapy 统计信息意味着什么?我的代码在这里。我将不胜感激在这件事上的任何帮助。
import scrapy
from scrapy.http.request import Request
from scrapy.spiders import BaseSpider
from scrapy.selector import HtmlXPathSelector
class BotSpider_2(BaseSpider):
name = 'BotSpider_2'
name = "google.co.th"
start_urls = ["http://www.google.co.th/"]
def parse(self, response):
sel = Selector(response)
sites = sel.xpath('//title/text()').extract()
print sites
【问题讨论】:
标签: scrapy