【发布时间】:2013-08-11 13:53:47
【问题描述】:
以下是我尝试从中提取视频标题的网站的部分:
</div>
<div class="yt-lockup-content">
<h3 class="yt-lockup-title">
<a class="yt-uix-sessionlink yt-uix-tile-link yt-uix-contextlink
yt-ui-ellipsis yt-ui-ellipsis-2"
dir="ltr"
title="Harder Polynomials"
data-sessionlink="ei=fYsHUvSLA8uzigLq74CABQ&ved=CB8Qvxs&feature=c4-videos-u"
href="/watch?v=LHvQeBRLFn8"
>
Harder Polynomials
</a>
我希望从中提取视频标题(更难的多项式)。我试过以下代码:
import requests
from bs4 import BeutifulSoup
resp=requests.get('http://www.youtube.com/user/sachinabey/videos')
a=soup.findAll('a', attrs={'class': 'yt-uix-sessionlink yt-uix-tile-link yt-uix- contextlink yt-ui-ellipsis yt-ui-ellipsis-2'})
a 是空的,我做错了什么。 如何从这里提取标题
【问题讨论】:
-
如果你尝试
a = soup.findAll('a', attrs={'class':'yt-uix-sessionlink'}),你会得到一个有效的“a”值吗??
标签: python beautifulsoup