【发布时间】:2021-11-16 10:02:57
【问题描述】:
他们向我展示了错误ValueError: 60 columns passed, passed data had 282 columns 如何解决这些错误这是页面链接https://www.basketball-reference.com/boxscores/202110190MIL.html 如果您转到点击Q1 的页面并按照图片中显示的那样刮取 1 个表格
import requests
from bs4 import BeautifulSoup
import pandas as pd
headers= {'User-Agent': 'Mozilla/5.0'}
#put all item in this array
temp = []
response = requests.get('https://www.basketball-reference.com/boxscores/202110190MIL.html')
soup = BeautifulSoup(response.content, 'html.parser')
table=soup.find('table', class_='sortable stats_table')
headers=[tup.text for tup in table.find_all("th")]
for row in table:
temp.append([row.text for row in table.find_all('td')])
df = pd.DataFrame(temp,columns=headers)
print(df)
【问题讨论】:
标签: html web-scraping beautifulsoup