【发布时间】:2016-11-03 16:00:09
【问题描述】:
我试图使用link 中给出的脚本获取评论信息。我能够获得一个页面。有没有办法让它用于多个页面。以下是代码:
import requests
data = {"productId": "MOBEG4XWJG7F9A6Z", # end of url pid=MOBEG4XWJG7F9A6Z
"count": "15",
"ratings": "ALL",
"reviewerType:ALL"
"sortOrder": "MOST_HELPFUL"}
headers = ({"x-user-agent":"Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/53.0.2785.92 Safari/537.36 FKUA/website/41/website/Desktop"})
data = requests.get("https://www.flipkart.com/api/3/product/reviews", params=data, headers=headers).json()
我尝试更改参数如下:
data = {"productId": "MOBEG4XWJG7F9A6Z", # end of url pid=MOBEG4XWJG7F9A6Z
"count": "15",
"ratings": "ALL",
"reviewerType:ALL"
"sortOrder": "MOST_HELPFUL",
"page": "2"}
但我得到了与以前相同的评论。我尝试使用以下命令获取 URL 路径:
data.request.path_url
当我尝试将获得的 URL 粘贴到浏览器中时,它返回错误。 有什么方法可以找到用于迭代页码的参数。请帮助。我是 Python 新手
【问题讨论】:
标签: python selenium beautifulsoup