【发布时间】:2019-07-01 21:37:23
【问题描述】:
我一直在尝试从一个似乎有多个 html 级别的网站中提取一些数据。从我看到的所有示例中,我想到 BeautifulSoup 是一个很棒的产品,如果你试图找到嵌套在树下不那么远的数据。
对于我的小项目,我正在尝试让 BeautifulSoup 从以下位置提取数据。
任何帮助将不胜感激。
<html lang=“en”>
<body>
<div id=“wrapper”>
<div id=“app_timeline”>
<div id=“timeline-summary”
<div id=“timeline-summary-sticky”>
<div class=“summary-list”>
<div>
<div class=“summary-type”>
<div class=“details”>
<div class=“value”>
<div>
<span class=“number”>100</span>
数字 100 每天都在变化,所以我想写一些东西,当我运行一些 python 代码时可以提取这些数据。
TIA
【问题讨论】:
-
使用你的方法它返回“无”,除非它在 html 中走得不够远,否则没有意义?
-
Beautifulsoup 是一个不错的包,stackoverflow 上有很多问答。它对通过嵌套的html结构进行解析有很好的支持。提供更多关于您尝试过的内容、遇到的错误的详细信息。尝试找出类似的问答如何/为什么会或不会帮助您并发布您的发现。 stackoverflow.com/questions/1501690/… , stackoverflow.com/questions/1936466/… ,stackoverflow.com/questions/10524387/…
标签: python html beautifulsoup nested