【发布时间】:2016-04-12 03:42:15
【问题描述】:
如果我的班级名称经常不同,例如:
listing-col-line-3-11 dpt 41
listing-col-block-1-22 dpt 41
listing-col-line-4-13 CWK 12
通常我可以这样做:
for EachPart in soup.find_all("div", {"class" : "ClassNamesHere"}):
print EachPart.get_text()
这里有太多的类名需要使用,所以其中有很多。
我知道 Python 没有我通常会使用的“.contains”,但它确实有一个“in”。虽然我还没有找到一种方法来整合它。
我希望有一种方法可以使用正则表达式来做到这一点。虽然我的 Python 语法再次让我失望,但我一直在尝试以下方面的变化:
regex = re.compile('.*listing-col-.*')
for EachPart in soup.find_all(regex):
但这似乎并不奏效。
【问题讨论】:
标签: python regex web-scraping beautifulsoup