【发布时间】:2015-10-29 18:35:17
【问题描述】:
刮擦。如何使用 lxml 帮助从已解析 HTML 中的标签中删除样式属性(类或 id 属性)?类似lxml.html.clean.Cleaner 或类似的东西:
for tag in html.xpath('//*[@class]'):
tag.attrib.pop('class')
【问题讨论】:
-
您能否编辑您的问题并举例说明您得到了什么(使用您当前的代码)以及您想要什么?
-
我需要解析带有标签的项目,而不仅仅是文本。并解析项目样式完整。例如: item['asterisk1'][0] = '
- 1需要 InstantGo 或通过设备加密 HCK 测试的设备
'
标签: python html web-scraping scrapy