【发布时间】:2013-04-21 16:26:43
【问题描述】:
我正在抓取一个包含如下链接的页面:
<a id="something" href="place" class="thing" data="12345">
<span class="otherthing"></span></a>
我想提取名为 data 的字段中的数字。我一直在尝试像这样使用 BeautifulSoup:
soup = BeautifulSoup(response)
for a in soup.findAll('a'):
if 'data' in a['a']:
print a['a']['data']
但我遇到了一个关键错误。
【问题讨论】:
标签: python screen-scraping beautifulsoup