【发布时间】:2017-09-29 07:08:59
【问题描述】:
我正在尝试从此 html 代码中删除“href”链接:
我的代码是:
from selenium import webdriver
from splinter import Browser
from bs4 import BeautifulSoup
import requests as tt
ar=webdriver.Chrome('/Users/exepaul/Downloads/chromedriver/chromedriver')
url="https://www.python.org/about/"
browser=Browser("chrome")
browser.visit(url)
find_h=browser.find_by_css('div[class="medium-widget success-story-category last"]:nth-child(3) > ul:nth-child(1) > li:nth-child(1) > a')
for i in find_h:
print(i["href"])
但它什么也没返回
【问题讨论】:
-
看起来你在混合
xpath和css,试试这个:'div.medium-widget.success-story-category.last:nth-child(3) > ul:nth-child(1) > li:nth-child(1) > a' -
相同的结果,没有返回。
-
这个
'div.medium-widget.success-story-category.last > ul > li:first-child > a'似乎对我有用。由于它的父级中只有一个<ul>和<a>标签,因此不需要'nth-child(1)' ...如果是这样,则有一个:first-child伪类
标签: python css python-3.x selenium beautifulsoup