【发布时间】:2016-09-29 08:06:57
【问题描述】:
我正在编写一个 Python 2.7 脚本来从网站中提取日期。代码如下:
from lxml import html, etree
from urllib2 import urlopen
import requests
url = 'http://www.cardiffdevils.com/fixtures/'
newtree = etree.HTML(urlopen(url).read())
for section in newtree.xpath('//div[@class="month"]'):
print section.xpath('h3[1]/text()')
print section.xpath('//td[@class="date"]/text()')
月份输出正确,但我试图将每个部分的打印日期限制为仅在相应的“月份”类中找到的日期;目前它会吐出在整个页面中找到的所有日期。任何指针将不胜感激!
【问题讨论】: