【发布时间】:2019-05-02 09:05:39
【问题描述】:
我已经从网页中提取数据,但我无法从没有唯一标识符的网页中提取数据
我已经尝试从具有唯一标识符(例如 class 、span 、id )的网页中提取数据,但是当页面没有唯一标识符时该怎么办
url="https://dblp.org/"
r=requests.get(url)
print(r.content)
b=BeautifulSoup(r.text,"html.parser")
print(b.prettify())
a=b.find_all('ul',{"id":"browsable"}) #no id is available
它实际上显示 None 预期结果应该是可用链接列表
【问题讨论】:
-
你在寻找什么链接?
标签: html web-scraping data-extraction