如何从lxml树中删除命名空间?

LCG*_*CGA 6 python xml lxml prefix xml-namespaces

继续使用python删除XML中的子元素 ...

感谢@Tichodroma,我有这个代码:

如果你可以使用lxml,试试这个:

 import lxml.etree

 tree = lxml.etree.parse("leg.xml")
 for dog in tree.xpath("//Leg1:Dog",
                       namespaces={"Leg1": "http://what.not"}):
     parent = dog.xpath("..")[0]
     parent.remove(dog)
     parent.text = None
 tree.write("leg.out.xml")
Run Code Online (Sandbox Code Playgroud)

现在leg.out.xml看起来像这样:

 <?xml version="1.0"?>
 <Leg1:MOR xmlns:Leg1="http://what.not" oCount="7">
   <Leg1:Order>
     <Leg1:CTemp id="FO">
       <Leg1:Group bNum="001" cCount="4"/>
       <Leg1:Group bNum="002" cCount="4"/>
     </Leg1:CTemp>
     <Leg1:CTemp id="GO">
       <Leg1:Group bNum="001" cCount="4"/>
       <Leg1:Group bNum="002" cCount="4"/>
     </Leg1:CTemp>
   </Leg1:Order>
 </Leg1:MOR>
Run Code Online (Sandbox Code Playgroud)

如何修改我的代码以Leg1:从所有元素的标记名称中删除名称空间前缀?

har*_*r07 10

从每个元素中删除名称空间前缀的一种可能方法:

def strip_ns_prefix(tree):
    #iterate through only element nodes (skip comment node, text node, etc) :
    for element in tree.xpath('descendant-or-self::*'):
        #if element has prefix...
        if element.prefix:
            #replace element name with its local name
            element.tag = etree.QName(element).localname
    return tree
Run Code Online (Sandbox Code Playgroud)

另一个在xpath中使用命名空间检查而不是使用if语句的版本:

def strip_ns_prefix(tree):
    #xpath query for selecting all element nodes in namespace
    query = "descendant-or-self::*[namespace-uri()!='']"
    #for each element returned by the above xpath query...
    for element in tree.xpath(query):
        #replace element name with its local name
        element.tag = etree.QName(element).localname
    return tree
Run Code Online (Sandbox Code Playgroud)

  • 您可能还需要调用`etree.cleanup_namespaces(tree)` - 否则`etree.tostring(tree)`仍会显示名称空间. (3认同)
  • 第二种方法更健壮(默认命名空间) (3认同)
  • 谢谢这个完美的工作.它也非常适合我的方法. (2认同)