【问题标题】:Reading xml with lxml lib geting strange string from xmlns tag使用lxml lib读取xml从xmlns标签中获取奇怪的字符串
【发布时间】:2017-10-06 08:38:07
【问题描述】:

我正在编写程序来处理 xml 文件并对其进行更改。但是,当我尝试进入其中的任何部分时,我会得到一些额外的部分。

我的 xml 文件:

<?xml version="1.0" encoding="UTF-8"?>
<Package xmlns="http://soap.sforce.com/2006/04/metadata">
    <types>
        <members>sbaa__ApprovalChain__c.ExternalID__c</members>
        <members>sbaa__ApprovalCondition__c.ExternalID__c</members>
        <members>sbaa__ApprovalRule__c.ExternalID__c</members>
       <name>CustomField</name>
    </types>
    <version>40.0</version>
</Package>

我有我的代码:

from lxml import etree
import sys

tree = etree.parse('package.xml')
root = tree.getroot()
print( root[0][0].tag )

作为输出,我希望看到成员,但我得到的是这样的:

{http://soap.sforce.com/2006/04/metadata}members

为什么我会看到该网址以及如何阻止它显示?

【问题讨论】:

    标签: python xml lxml


    【解决方案1】:

    您已定义默认命名空间(Wikipedialxml tutorial)。定义后,它是每个子标签的一部分。

    如果你想打印没有命名空间的标签,很简单

    tag = root[0][0].tag
    print(tag[tag.find('}')+1:])
    

    如果您想从 XML 中删除命名空间,请参阅 this question

    【讨论】:

      猜你喜欢
      • 2014-10-19
      • 1970-01-01
      • 1970-01-01
      • 2018-07-25
      • 1970-01-01
      • 2012-01-14
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多