【发布时间】:2016-12-26 05:09:28
【问题描述】:
我一直在为这个网站 (http://www.bobaedream.co.kr/cyber/CyberCar.php?gubun=I&page=1) 开发一个网络爬虫。但是我在抓取股票的每个标题时遇到了麻烦。我很确定 carinfo_title = carinfo.find_all('a', class_='title') 有属性。
请查看附件代码和网站代码,然后给我任何建议。
谢谢。
(网站代码)
https://drive.google.com/open?id=0BxKswko3bYpuRV9seTZZT3REak0
(我的代码)
from bs4 import BeautifulSoup
import urllib.request
target_url = "http://www.bobaedream.co.kr/cyber/CyberCar.php?gubun=I&page=1"
def fetch_post_list():
URL = target_url
res = urllib.request.urlopen(URL)
html = res.read()
soup = BeautifulSoup(html, 'html.parser')
table = soup.find('table', class_='cyber')
#Car Info and Link
carinfo = table.find_all('td', class_='carinfo')
carinfo_title = carinfo.find_all('a', class_='title')
print (carinfo_title)
return carinfo_title
fetch_post_list()
【问题讨论】:
标签: python-3.x attributes beautifulsoup web-crawler