【发布时间】:2019-01-30 16:56:36
【问题描述】:
我一直倾向于网络爬虫,所以我决定练习一下。 使用这个网站(https://lista.mercadolivre.com.br/razer?matt_tool=6263806&matt_word=RAZER_MERCADO_LIVRE&gclid=CjwKCAiAs8XiBRAGEiwAFyQ-ejETB12X8G75icDJLMkW4ChSyBsJLrL3wZv_o3oZb8zvtUsc5D1tZBoCsNEQAvD_BwE),我想我会尝试在第一页收集每个产品的描述和价格。我能够得到很好的描述,但我遇到了价格问题。
例如,给定第一个产品,价格是数字 559。但是,当我使用 produto1.div.span.text 时,Python 只给了我“R$”,这是我不想要的。
我该怎么做才能得到实际价格?
我的代码:
url = 'https://lista.mercadolivre.com.br/razer?matt_tool=6263806&matt_word=RAZER_MERCADO_LIVRE&gclid=CjwKCAiAs8XiBRAGEiwAFyQ-ejETB12X8G75icDJLMkW4ChSyBsJLrL3wZv_o3oZb8zvtUsc5D1tZBoCsNEQAvD_BwE'
response = get(url)
html_soup = BeautifulSoup(response.text, 'html.parser')
produtos = html_soup.find_all('div', class_ = "item__info item__info--with-reviews")
produto1 = produtos[0]
produto1.div.span.text
【问题讨论】:
-
欢迎来到 StackOverflow。请按照您创建此帐户时的建议阅读并遵循帮助文档中的发布指南。 Minimal, complete, verifiable example 适用于此。在您发布 MCVE 代码并准确描述问题之前,我们无法有效地帮助您。我们应该能够将您发布的代码粘贴到文本文件中并重现您描述的问题。您的代码未按照发布的方式运行:BS 未导入,
get未解析。
标签: python loops web-scraping beautifulsoup request