【发布时间】:2018-02-12 03:13:08
【问题描述】:
<div class="row features_2 "><br />
<ul>
<li><b>Área privada:</b><br />
70,00 m²
</li>
<!--area-->
<li><b>Área Const.:</b><br />
70,00 m²
</li>
<!--precio metro cuadrado-->
<li><b>Precio m²:</b><br />
3.142.857/m²
</li>
<!--Valor noche si es alquiler vacacional-->
<!--precio de administracion -->
<li><b>Admón:</b><br />
$150,000</li>
<!--Estrato si aplica-->
<li><b>Estrato:</b> <br />
3
<!--Estado si aplica-->
<li><b>Estado:</b> <br />
Excelente
</li>
<!--edad si aplica-->
<li><b>Antigüedad:</b> <br />
1 a 8 años</li>
<!--piso #-->
<!--Clima-->
<!--tipo de apartamento si aplica-->
<!--para parqueaderos-->
<!--caracteristicas parqueadero-->
<!--Sector (siempre va)-->
<li><b>Sector:</b> <br />
<a href="#pnlMap" style="font-weight: bold;">Ver Mapa</a>
</li>
</ul>
从上面我想获取标签内的值,但是我在将值保存到单个列表时遇到了麻烦。
我想根据自身内部的数据保存值。
例如,如果标签包含“Área privada:”,那么我必须将值“70,00 m²”保存到列表名称区域
如果标签包含 'Precio m²:' ,那么我必须将值 3.142.857/m² 保存到名为 Precio 的列表中
我尝试了以下代码来获取元素,但不确定如何根据上述条件编写将数据保存到列表中的条件。
import requests
from bs4 import BeautifulSoup
page = requests.get('https://www.fincaraiz.com.co/oceana-52/barranquilla/proyecto-nuevo-det-1041165.aspx')
soup = BeautifulSoup(page.content, 'lxml')
box_3 = soup.find('div' ,'row features_2 ')
box_3_1 = box_3.findAll('li')
for i in box_3_1:
print (i)
还有其他选项可以将上述标签中的数据保存到相应的列表中。
【问题讨论】:
-
br标签不包含任何数据.. -
html 看起来很混乱。
-
所以只添加了python代码从网页中获取html元素
标签: python python-3.x web-scraping beautifulsoup