【发布时间】:2016-01-10 12:01:54
【问题描述】:
我有一个使用 Beautiful Soup 4 解析的 html 文件,这是我感兴趣的部分
[
<td>Name :</td>, <td>xyz</td>,
<td>Mobile :</td>, <td>180-14587962</td>,
<td>Company:</td>, <td>abc Comp</td>,
<td>Name :</td>, <td> </td>,
<td>Mobile :</td>, <td> </td>,
<td>Company:</td>, <td> </td>,
<td>Name :</td>, <td> </td>,
<td>Mobile :</td>, <td> </td>
]
我只需要分别提取 Name 和 Mobile(它们在解析树中处于同一级别)。我该怎么做?我已经尝试使用 soup.find_next_siblings method 但无法以所需格式存储数据( Number 和 Mobile 的两个单独列表)
【问题讨论】:
标签: python python-3.x web-scraping beautifulsoup bs4