【发布时间】:2016-10-17 10:10:58
【问题描述】:
import requests
from bs4 import BeautifulSoup
My_Url = "http://questions.consumercomplaints.in/page/2"
Data = requests.get(My_Url)
Soup = BeautifulSoup(Data.content)
head_id = Soup.find_all({"div":"href"})
len(head_id)
for i in head_id:
print i.text
从上面的代码中,我从网页 2 中删除(评论/投诉)。 我如何自动抓取所有页面的数据(http://questions.consumercomplaints.in/page/3)
【问题讨论】:
标签: python python-2.7 web-scraping web-crawler ipython