【发布时间】:2015-03-20 14:08:33
【问题描述】:
我正在尝试将此网站上的参与者姓名和赔率放入一个列表或表格中,然后我可以进行计算。我想在下面这样的有序输出中查看数据
1.name / odds vs name / odds
2.name / odds vs name / odds
目前我似乎只能单独抓取它们,当我打印它们时,它们仍然包含 HTML 标签。
import requests
from bs4 import BeautifulSoup
url = requests.get('http://www.oddschecker.com/tennis/match-coupon')
html = url.content
soup = BeautifulSoup(html)
odds = soup.find_all("span", "odds")
print(odds)
一旦我能够以上述格式构建数据,我希望能够对数据进行计算。
【问题讨论】:
标签: web-scraping beautifulsoup html-parsing python-3.4