【发布时间】:2021-11-29 05:32:45
【问题描述】:
我想在不同的页面中抓取一些信息。下面的代码可以帮助我用 print() 函数抓取信息。
问题是我只从最后一页获取数据。上一页的结果无法写入 CSV 文件。我该怎么办?谢谢。
代码:
enter code here
import requests
from csv import writer
from bs4 import BeautifulSoup
urls = ['https://www.xxxxxxxxxxxxxxx/02-nb.php','https://www.xxxxxxxxxxxxxxx/03-np.php','https://www.xxxxxxxxxxxxxxx/04-nb.php']
for index,url in enumerate(urls):
requests.get(url)
page = requests.get(url)
soup = BeautifulSoup(page.text, 'lxml')
print(soup)
table_data = soup.find('table')
with open("words.csv", "wt",newline='',encoding='utf-8') as csv_file:
csv_data = writer(csv_file, delimiter =',')
for voc in table_data.find_all('tr'):
row_data = voc.find_all('td')
row = [tr.text for tr in row_data]
csv_data.writerow(row)
【问题讨论】:
标签: python csv web-scraping beautifulsoup