【发布时间】:2020-06-30 14:14:38
【问题描述】:
使用 Beautiful Soup,我正在尝试从 HTML 表中抓取数据,如下所示:
<table class="ipl-zebra-list ipl-zebra-list--fixed-first release-dates-table-test-only">
<tr class="ipl-zebra-list__item release-date-item">
<td class="release-date-item__country-name"><a href="/calendar/?region=de">Germany
</a></td>
<td align="right" class="release-date-item__date">15 September 2017</td> <td align="left" class="release-date-item__attributes">(Oldenburg Film Festival)
</td>
</tr>
<tr class="ipl-zebra-list__item release-date-item">
<td class="release-date-item__country-name"><a href="/calendar/?region=gb">UK
</a></td>
<td align="right" class="release-date-item__date">23 March 2018</td> <td class="release-date-item__attributes--empty"></td>
</tr>
</table>
我正在寻找出现在 <td> 元素的兄弟元素中的日期,其中包括以下 href:
<a href="/calendar/?region=gb">UK
在上面的示例中,此日期为 2018 年 3 月 23 日,但出现 href 的每个实例的日期都不同。但是 href 总是相同的。
总而言之,我正在寻找出现在与上面列出的 href 相邻单元格中的数据。
谢谢!
【问题讨论】:
标签: python html web-scraping beautifulsoup