【发布时间】:2019-08-16 03:54:37
【问题描述】:
我是 Python 编程和 Web Scraping 的绝对初学者。 我试图抓取一个网站用于练习。
我使用了 BeautifulSoup 和 Requests 模块。
代码如下:
import requests
import xlwt
from bs4 import BeautifulSoup
from csv import writer
response=requests.get("https://www.wikipedia.org/")
wb=xlwt.Workbook()
ws=wb.add_sheet("Test")
soup=BeautifulSoup(response.content,"html.parser")
links=soup.find_all("strong")
for link in links:
lang=link.get_text()
for i in len(lang):
ws.write(i,i,lang)
wb.save("Wiki.xls")
我已经从网页上抓取了标题,但在将其写入 excel 文件时显示以下错误。
File "C:/Users/laptop/PycharmProjects/myproject/srapingex1.py", line 16, in <module>
for i in len(str(lang)):
TypeError: 'int' object is not iterable
主要问题是ws.write(row,column,data)的语法需要行地址、列地址和数据。
由于我不知道列表的预定义大小,所以如何传递行、列地址。
请告知我是否错误地执行代码,并建议是否有任何方法可以将提取的项目写入 .xls 文件。
【问题讨论】:
标签: python csv web-scraping beautifulsoup