【发布时间】:2021-09-15 06:48:09
【问题描述】:
我正在尝试从网站上抓取新闻文章。我只对包含<span class="news_headline"> 和文本“Transfers”的文章感兴趣。从这篇文章中,我想从<div class="news_text"> 中提取跨度内的文本。结果应以 csv 文件结尾,如下所示:
R.Wolf; wechselt für 167.000 von Computer zu; Hauke
Weiner; wechselt für 167.000 von Computer zu; Hauke
Gonther; wechselt für 770.000 von Computer zu; Hauke
或
3378; wechselt für 167.000 von Computer zu; 514102
3605; wechselt für 167.000 von Computer zu; 514102
1197; wechselt für 770.000 von Computer zu; 514102
我对编程很陌生,所以我希望任何人都可以提供帮助。
<div class="single_news_container">
<div class="news_body_right single_news_content">
<div class="cont_news_headlines">
<span class="wrapper_news_headlines">
<span class="news_headline">Transfers</span>
</span>
</div>
<div class="news_text">
<div>
<p>
<span><a href="/2.bundesliga/players/R. Wolf-3378">R. Wolf</a> wechselt für 167.000 von Computer zu <a href="/users/514102">Hauke</a></span>
</p>
<p>
<span><a href="/2.bundesliga/players/Weiner-3605">Weiner</a> wechselt für 167.000 von Computer zu <a href="/users/514102">Hauke</a></span>
</p>
<p>
<span><a href="/2.bundesliga/players/Gonther-1197">Gonther</a> wechselt für 770.000 von Computer zu <a href="/users/514096">Christoph</a></span>
</p>
</div>
</div>
</div>
</div>
【问题讨论】:
标签: python beautifulsoup