【发布时间】:2020-06-04 16:11:21
【问题描述】:
我希望结果中有 2 个不同类的 div 标签。 我正在使用以下命令 scrape 数据 - '''
result = soup.select('div', {'class' : ['col-s-12', 'search-page-text clearfix row'] })
'''
现在,我在“col-s-12”类中有一组特定的信息,而在“search-page-text clearfix row”类中有另一组信息 现在,我想找到只有 div 标签的子类 - 'col-s-12'。当我在代码下方运行时,它会查找两个 div 标记的子级,因为我没有在任何地方指定要搜索的类
'''
for div in result:
print(div)
prod_name = div.find("a" , recursive=False)[0] #should come from 'col-s-12' only
prod_info = div.find("a" , recursive=False)[0] # should come from 'search-page-text clearfix row' only
'''
示例 - '''
<div class = 'col-s-12'>
<a href = "some_link"> This is what I want or variable **prod_name** </a>
</div>
<div class = 'search-page-text clearfix row'>
<a> This should be stored in variable **prod_info** </a>
</div>
'''
【问题讨论】:
标签: python-3.x web-scraping beautifulsoup