【发布时间】:2018-03-26 15:58:34
【问题描述】:
这似乎与我之前的帖子相似(我将在底部链接),但这是一个不同的 url,它使用表格。当我运行以下代码时,我可以获得提取的所有数据:
import requests
from bs4 import BeautifulSoup
url = "https://www.nascar.com/wp-content/plugins/raw-feed/raw-feed.php"
r = requests.get(url)
soup = BeautifulSoup(r.text, "lxml")
try:
data = soup.find('div', class_='div-col1')
print(data)
except:
print("You Get Nothing!")
然后我将尝试更改为
try:
data = soup.find_all('td', class_='car')
print(data)
except:
print("You Get Nothing!")
我只从thead 而不是tbody 中获取信息
我有什么遗漏或做错了吗?我越想确定,我要么出错,要么只返回空 []
另外,这个网页是动态的,我尝试了在我之前的帖子 Old Post 中给我的内容,我知道这两个页面之间的布局和编码是不同的,但我担心的是每次加载 Chrome我运行脚本的时间会很多,因为它可能需要每 30sec-1min 刷新 300-400 次 tp。
【问题讨论】:
标签: python web-scraping beautifulsoup