【发布时间】:2017-01-01 05:03:48
【问题描述】:
我正在使用 python 3.6 和 pycharm 2016.2 并尝试抓取网站。
在“보험사고이력 정보 : 내차 피해”(包括第五个表)类别中,如果“p tag”之一的内容中有“-사고일자”,我会尝试抓取数据。
下面是我的代码。它一直没有返回任何东西。
请帮忙。
from bs4 import BeautifulSoup
import urllib.request
from urllib.parse import urlparse
import re
popup_insurance = "http://www.bobaedream.co.kr/mycar/popup/mycarChart_B.php?car_number=35%EB%91%908475&tbl=cyber&cno=651451"
res = urllib.request.urlopen(popup_insurance)
html = res.read()
soup_insurance = BeautifulSoup(html, 'html.parser')
insurance_content_table = soup_insurance.find_all('table')
elem = soup_insurance.find("p", text="보험사고이력 정보 : 내차 피해")
while elem.string != "보험사고이력 정보 : 타차 가해":
if "사고일자" in elem.next_sibling:
print(elem.next_sibling)
elem = elem.next_sibling
if elem is None:
break
【问题讨论】:
标签: python-3.x encoding web-crawler