python解析XML文件实例（图）-Python教程-PHP中文网

首页

后端开发

Python教程

python解析XML文件实例（图）

PHPz

Apr 23, 2017 pm 04:44 PM

pythonxml

如下使用xml.etree.ElementTree模块来解析XML文件。ElementTree模块中提供了两个类用来完成这个目的：

ElementTree 表示整个XML文件（一个树形结构）
Element 表示树中的一个元素（结点）

我们操作如下XML文件： migapp.xml

python解析XML文件实例（图）

我们可以通过如下方式导入ElementTree模块： import xml.etree.ElementTree as ET

或者也可以仅导入parse解析器： from xml.etree.ElementTree import parse

首先需要打开一个xml文件，本地文件使用open函数，如果是互联网文件，则使用urlopen:

f = open( ' migapp.xml ' , ' rt ' , encoding= ' utf-8 ' )

然后对XML进行解析。

1 解析XML文件

1.1 解析根元素

tree = ET.parse(f)
root = tree.getroot()
print(&#39;root.tag =&#39;, root.tag)
print(&#39;root.attrib =&#39;, root.attrib)

python解析XML文件实例（图）

1.2 解析根的儿子

for child in root:      # 仅可以解析出root的儿子，不能解析出root的子孙
    print(child.tag)
    print(child.attrib) # attrib is a dict

python解析XML文件实例（图）

1.3 通过索引解析根的子孙

print(root[1][1].tag)
print(root[1][1].text)

python解析XML文件实例（图）

1.4 迭代解析出所有的指定element

for element in root.iter('environment'):
    print(element.attrib)

python解析XML文件实例（图）

1.5 几个有用的方法

# element.findall()解析出指定element的所有儿子
# element.find()解析出指定element的第一个儿子
# element.get()解析出指定element的属性attrib
for environment in root.findall(&#39;environment&#39;):
    first_variable = environment.find(&#39;variable&#39;)
    print(first_variable.get(&#39;name&#39;))

python解析XML文件实例（图）

2 修改XML文件

假设我们需要给每个text元素添加一个属性size="50"，修改其text为"Benxin Tuzi"，添加一个子元素date="2016/01/16"

for text in root.iter(&#39;text&#39;):
    text.set(&#39;size&#39;, &#39;50&#39;)
    text.text = &#39;Benxin Tuzi&#39;
    text.append(ET.Element(&#39;date&#39;, attrib={}, text=&#39;2016/01/16&#39;))
tree.write(&#39;output.xml&#39;)

migapp.xml 中的部分：

python解析XML文件实例（图）

output.xml 中对应的部分：

python解析XML文件实例（图）

3 说明事项

不要使用xml.py作为文件名，否则此时会发生如下错误：

ImportError: No module named 'xml.etree'; 'xml' is not a package

分析：

这是由于import时会先在当前路径下寻找，此时发现存在xml.py模块，而我们自己写的xml.py当然不是一个package

注意：

删除xml.py后仍然不能成功解释，那是因为当前路径中还生成了xml.pyc，而该文件的优先级要高于xml.py，因此解释器还是优先在xml.pyc中寻找，因此必须将该文件也删除掉，成功解决问题。

结论：

文件名尽量不要与包名或者模块名同名，即使你在脚本中不使用该模块或者包，否则可能发生奇怪的错误。

ElementTree模块中提供的很多解析函数都需要预先将整个XML文档读入内存中，这对于大型XML解析而言，不是一件好事，尤其是当我们从网络、管道中读取XML时，非阻塞式的解析非常重要。此时，我们可以使用ElementTree模块中的XMLPullParse类来处理。当然我们也可以选择ElementTree模块的iterparse()来代替，该方法在解析大型XML时也不需要全部读入内存。

以上是python解析XML文件实例（图）的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

如何用PHP和XML实现网站的分页和导航Jul 28, 2023 pm 12:31 PM

如何用PHP和XML实现网站的分页和导航导言：在开发一个网站时，分页和导航功能是很常见的需求。本文将介绍如何使用PHP和XML来实现网站的分页和导航功能。我们会先讨论分页的实现，然后再介绍导航的实现。一、分页的实现准备工作在开始实现分页之前，需要准备一个XML文件，用来存储网站的内容。XML文件的结构如下：<articles><art

XML外部实体注入漏洞的示例分析May 11, 2023 pm 04:55 PM

一、XML外部实体注入XML外部实体注入漏洞也就是我们常说的XXE漏洞。XML作为一种使用较为广泛的数据传输格式，很多应用程序都包含有处理xml数据的代码，默认情况下，许多过时的或配置不当的XML处理器都会对外部实体进行引用。如果攻击者可以上传XML文档或者在XML文档中添加恶意内容，通过易受攻击的代码、依赖项或集成，就能够攻击包含缺陷的XML处理器。XXE漏洞的出现和开发语言无关，只要是应用程序中对xml数据做了解析，而这些数据又受用户控制，那么应用程序都可能受到XXE攻击。本篇文章以java

php如何将xml转为json格式？3种方法分享Mar 22, 2023 am 10:38 AM

当我们处理数据时经常会遇到将XML格式转换为JSON格式的需求。PHP有许多内置函数可以帮助我们执行这个操作。在本文中，我们将讨论将XML格式转换为JSON格式的不同方法。

Python中xmltodict对xml的操作方式是什么May 04, 2023 pm 06:04 PM

Pythonxmltodict对xml的操作xmltodict是另一个简易的库，它致力于将XML变得像JSON.下面是一个简单的示例XML文件:elementsmoreelementselementaswell这是第三方包，在处理前先用pip来安装pipinstallxmltodict可以像下面这样访问里面的元素，属性及值:importxmltodictwithopen("test.xml")asfd:#将XML文件装载到dict里面doc=xmltodict.parse(f

使用nmap-converter将nmap扫描结果XML转化为XLS实战的示例分析May 17, 2023 pm 01:04 PM

使用nmap-converter将nmap扫描结果XML转化为XLS实战1、前言作为网络安全从业人员，有时候需要使用端口扫描利器nmap进行大批量端口扫描，但Nmap的输出结果为.nmap、.xml和.gnmap三种格式，还有夹杂很多不需要的信息，处理起来十分不方便，而将输出结果转换为Excel表格，方面处理后期输出。因此，有技术大牛分享了将nmap报告转换为XLS的Python脚本。2、nmap-converter1）项目地址：https://github.com/mrschyte/nmap-

深度使用Scrapy：如何爬取HTML、XML、JSON数据？Jun 22, 2023 pm 05:58 PM

Scrapy是一款强大的Python爬虫框架，可以帮助我们快速、灵活地获取互联网上的数据。在实际爬取过程中，我们会经常遇到HTML、XML、JSON等各种数据格式。在这篇文章中，我们将介绍如何使用Scrapy分别爬取这三种数据格式的方法。一、爬取HTML数据创建Scrapy项目首先，我们需要创建一个Scrapy项目。打开命令行，输入以下命令：scrapys

xml中node和element的区别是什么Apr 19, 2022 pm 06:06 PM

xml中node和element的区别是：Element是元素，是一个小范围的定义，是数据的组成部分之一，必须是包含完整信息的结点才是元素；而Node是节点，是相对于TREE数据结构而言的，一个结点不一定是一个元素，一个元素一定是一个结点。

Python中怎么对XML文件的编码进行转换May 21, 2023 pm 12:22 PM

1.在Python中XML文件的编码问题1.Python使用的xml.etree.ElementTree库只支持解析和生成标准的UTF-8格式的编码2.常见GBK或GB2312等中文编码的XML文件，用以在老旧系统中保证XML对中文字符的记录能力3.XML文件开头有标识头，标识头指定了程序处理XML时应该使用的编码4.要修改编码，不仅要修改文件整体的编码，还要将标识头中encoding部分的值修改2.处理PythonXML文件的思路1.读取&解码：使用二进制模式读取XML文件，将文件变为

See all articles