【发布时间】:2017-04-18 06:45:02
【问题描述】:
import scrapy
import json
class GettingtonDSpider(scrapy.Spider):
name = "gettington_d"
allowed_domains = ["gettington.com"]
start_urls = ['https://api.gettington.com/v1/products?showMPP=false&rows=24&q=Keyword:south%20shore%20furniture&productfilter=null&callback=searchCallback']
def parse(self, response):
jsonresp = json.dumps(response.body)
jsonresp= json.loads(jsonresp)
我尝试了很多方法,但都失败了:
- response.text
- 编码('utf-8')
- response_body_as_unicode
以上都不起作用。错误如何解决?
【问题讨论】:
-
您是否遇到任何错误?有什么具体问题吗? “以上都不起作用。”不是很有帮助。
-
是的,我得到了 [json object could not be decoded]。
-
print(response.body) 的输出是什么?
-
url 带有浏览器元数据的产品信息,例如 searchCallback({metadata:{},products : {})
-
这不是 json 可序列化的。
标签: python-2.7 web-scraping scrapy screen-scraping scrapy-spider