【发布时间】:2021-03-10 03:19:26
【问题描述】:
我正在学习如何从网页中迭代抓取值,我以前使用过bs4,但我不知道为什么,即使这是一个简单的例子,我得到一个空列表(或元素)。
我要打印/保存的测试是:
<div data-v-1931433b="" class="mar-m c-r"> 9.1516 </div>
我使用的代码是:
1 import json
2 import requests
3 from bs4 import BeautifulSoup
4
5
6 url = 'https://goldencoreex.com/trade/index.html?spAsseType=0#/index'
7
8 html_page = BeautifulSoup(requests.get(url).content, 'html.parser')
9 elements = html_page.find_all("div", class_="mar-m c-r")
10
11 print(elements)
我对此问题的唯一猜测是我可能弄乱了网址。
我也非常感谢一些关于如何使代码连续运行的提示,以便在元素更新时捕获数据。
【问题讨论】:
-
页面是动态的,通过 javascript 呈现。您需要查看是否通过 API 请求数据或使用 Selenium 允许页面在获取 html 源代码之前呈现
标签: python web-scraping beautifulsoup