【发布时间】:2020-11-24 06:06:26
【问题描述】:
我正在尝试通过创建一个小型 websraping 程序来学习 python,以使生活更轻松,尽管我在使用 BS4 时遇到了仅获取数字的问题。我在抓取实际广告时能够获得价格,但我想从页面上获得所有价格。
这是我的代码:
from bs4 import BeautifulSoup
import requests
prices = []
url = 'https://www.kijiji.ca/b-cars-trucks/calgary/new__used/c174l1700199a49?ll=51.044733%2C-114.071883&address=Calgary%2C+AB&radius=50.0'
result = requests.get(url)
print (result.status_code)
src = result.content
soup = BeautifulSoup(src, 'html.parser')
print ("CLEARING")
price = soup.findAll("div", class_="price")
prices.append(price)
print (prices)
这是我的输出
[<div class="price">
$46,999.00
<div class="dealer-logo">
<div class="dealer-logo-image">
<img src="https://i.ebayimg.com/00/s/NjBYMTIw/z/xMQAAOSwi9ZfoW7r/$_69.PNG"/>
</div>
</div>
</div>
理想情况下,我只希望输出为“46,999.00”。
我尝试使用 text=True,虽然这不起作用,除了一个空列表之外,我不会从中获得任何输出。
谢谢
【问题讨论】:
-
请通过这个link
标签: python beautifulsoup