【发布时间】:2017-12-10 15:09:23
【问题描述】:
我正在构建一个应用程序,我想从 yahoo-finance 检索最新报价。我正在尝试使用 BeautifulSoup 抓取路径,但是当我打印时得到的只是一个空列表。有什么建议吗?
示例 HTML:
<span class="Trsdu(0.3s) Fw(b) Fz(36px) Mb(-4px) D(ib)" data-reactid="35"><!-- react-text: 36 -->169.37<!-- /react-text --></span>
我的代码:
import requests
from bs4 import BeautifulSoup
a = requests.get('https://finance.yahoo.com/quote/AAPL/history?p=AAPL')
soup = BeautifulSoup(a.content, 'lxml')
search = soup.find_all('span', {'class':'Trsdu(0.3s) Fw(b) Fz(36px) Mb(-4px)
D(ib)'})
print(search)
【问题讨论】:
-
页面的内容很可能是由 ajax 引入的——你无法对其进行 scape。如果幸运的话,他们提供了 APOI,因此您无需抓取任何内容 - 只需使用 API。
-
@PatrickArtner 你知道我是否可以取消实时股票价格吗?也许来自另一个来源?谢谢
-
你应该使用this library
标签: python web-scraping beautifulsoup yahoo-finance