【发布时间】:2017-05-18 17:04:30
【问题描述】:
我制作了解析evernote note xml 内容的函数。该注释包含名片数据。它由evernote xml-tags 表示。我必须获得的值的标签没有任何特定的ID。而获得所需标签的唯一方法是通过该标签的样式属性中包含的特定css值找到它。
xml 内容如下所示:
<span>
<span style="x-evernote:contact-org;
-evernote-editable:field;
font-size: 16px;
font-family: Helvetica;
color: #6f6f6f;
line-height: 22px;">Avratech</span>
</span>
这里唯一的css属性是x-evernote:contact-org;
我使用来自 xml.etree.ElementTree 模块的 X-path 值的“查找”方法。我遇到了两个问题:
- X 路径看起来很长。
例如:
company = contact_info.find('.//span[@style="x-evernote:contact-org;-evernote-editable:field;font-size: 16px;font-family: Helvetica; color: #6f6f6f;line-height: 22px;"]')
如果我跳过了其中一个 css 参数,它不会找到需要的标签。
- 如果所有 css
key:value;都写在新行,我的 X 路径搜索 不工作。
你能帮帮我吗?是否有其他模块更适用于此目的?
有一个evernotenote xml-content的例子。
【问题讨论】:
标签: python-3.x xml-parsing evernote