【发布时间】:2021-03-27 10:10:47
【问题描述】:
我使用 lxml 来获取 html 内容中的文本,如下所示:
a = '<span class="p_show">testa1:<a title="xxxx" href="/drama/MnJXVQ==">testa2</a></span>'
b = '<span class="p_show"><a title="xxxx" href="/drama/JFxhX2Nv">testb</a>1:testb2</span>'
代码在这里:
from lxml import etree
html = etree.HTML(a)
a1 = html.xpath('//span/text()')[0]
a2 = html.xpath('//span/a/text()')[0]
res = a1 + a2
res 是我想要的,但是对于 b 情况,我得到了相反的结果,你能帮我解决这个问题吗?谢谢这里的所有人!
【问题讨论】: