【发布时间】:2019-01-04 20:08:41
【问题描述】:
我想从网站上抓取以下 HTML 代码:
<td>Net Taxes Due<td>
<td class="value-column">$2,370.00</td>
<td class="value-column">$2,408.00</td>
我想要完成的是搜索页面以在标签中找到文本“Net Taxes Due”,找到标签的兄弟姐妹,并将结果发送到 Pandas 数据框。
我有以下代码:
soup = BeautifulSoup(url, "html.parser")
table = soup.select('#Net Taxes Due')
cells = table.find_next_siblings('td')
cells = [ele.text.strip() for ele in cells]
df = pd.DataFrame(np.array(cells))
print(df)
我一直在网上寻找解决方案,但无法提出任何建议。感谢任何帮助。
谢谢!
【问题讨论】:
标签: python web-scraping beautifulsoup