【发布时间】:2021-06-16 19:49:37
【问题描述】:
我已经添加了 HTML 和我编写的爬虫。我希望将p(2 个p 标签)标签内容打印在 1 行中。就像珍贵的 Achiuwa。然后在下一行,我要打印另外2个p元素内容。
<td class="primary text RosterRow_primaryCol__19xPQ">
<a class="flex items-center t6 Anchor_complexLink__2NtkO" href="/player/1630173/precious-achiuwa/">
<div class="w-8 h-8 mr-2">
<img alt="Precious Achiuwa Headshot" class="PlayerImage_image__1smob PlayerImage_round__281uY" loading="lazy" src="https://cdn.nba.com/headshots/nba/latest/260x190/1630173.png"/>
</div>
<div class="flex flex-col lg:flex-row">
<p class="t6 mr-1">
Precious
</p>
<p class="t6">
Achiuwa
</p>
</div>
</a>
</td>
from selenium import webdriver
from bs4 import BeautifulSoup as bs
driver = webdriver.Chrome(
executable_path=r'C:\Users\silvi\projects\selenium_basics\chromedriver.exe')
url = 'https://www.nba.com/players'
driver.get(url)
soup = bs(driver.page_source, 'lxml')
info_box = soup.find('table', class_='players-list')
names = info_box.find_all('p')
for name in names:
r = name.get_text(' ', strip=True)
print(r)
driver.quit()
【问题讨论】:
标签: python-3.x web-scraping beautifulsoup