【发布时间】:2019-02-23 17:50:59
【问题描述】:
我正在努力使用 BeautifulSoup。我想在[Transfermarkt][1]右侧的表格中抓取比赛的链接
到目前为止我是如何找到它的:
div1 = soup.find('div', {'class': 'large-4 columns'})
div2 = div1.find('div', {'class': 'box'})
table = div2.find('table')
table_body = table.find('tbody')
contest = table_body.find_all('a')
问题是这不够具体。我有时会发现双重值,这完全破坏了我的结构......
有没有更好的方法来定位这个确切的位置?
我需要的位置:“td”“class=no-border-links”中的“a”“title”
【问题讨论】:
标签: html python-3.x web-scraping beautifulsoup