python和xml简介的简单介绍

本文目录一览：

1、python 解析xml需要什么模块
2、用python怎么操作xml文件内容
3、python读取xml文件有哪些方法

python 解析xml需要什么模块

Python的标准库中，提供了6种可以用于处理XML的包。

（1）xml.dom

xml.dom实现的是W3C制定的DOM API。如果你习惯于使用DOM API或者有人要求这这样做，可以使用这个包。不过要注意，在这个包中，还提供了几个不同的模块，各自的性能有所区别。

DOM解析器在任何处理开始之前，必须把基于XML文件生成的树状数据放在内存，所以DOM解析器的内存使用量完全根据输入资料的大小。

（2）xml.dom.minidom

xml.dom.minidom是DOM API的极简化实现，比完整版的DOM要简单的多，而且这个包也小的多。那些不熟悉DOM的朋友，应该考虑使用xml.etree.ElementTree模块。据lxml的作者评价，这个模块使用起来并不方便，效率也不高，而且还容易出现问题。

用python怎么操作xml文件内容

一、什么是xml？

xml即可扩展标记语言，它可以用来标记数据、定义数据类型，是一种允许用户对自己的标记语言进行定义的源语言。

abc.xml

复制代码代码如下:

?xml version="1.0" encoding="utf-8"?

catalog

maxid4/maxid

captionPython/caption

item id="4"

caption测试/caption

/item

/login

item id="2"

captionZope/caption

/item

/catalog

Ok ,从结构上，它很像我们常见的HTML超文本标记语言。但他们被设计的目的是不同的，超文本标记语言被设计用来显示数据，其焦点是数据的外观。它被设计用来传输和存储数据，其焦点是数据的内容。

那么它有如下特征：

首先，它是有标签对组成，aa/aa

标签可以有属性：aa id='123'/aa

标签对可以嵌入数据：aaabc/aa

标签可以嵌入子标签（具有层级关系）：

二、获得标签属性

那么，下面来介绍如何用python来读取这种类型的文件。

复制代码代码如下:

#coding=utf-8

import xml.dom.minidom

#打开xml文档

dom = xml.dom.minidom.parse('abc.xml')

#得到文档元素对象

root = dom.documentElement

print root.nodeName

print root.nodeValue

print root.nodeType

print root.ELEMENT_NODE

mxl.dom.minidom 模块被用来处理xml文件，所以要先引入。

xml.dom.minidom.parse() 用于打开一个xml文件，并将这个文件对象dom变量。

documentElement 用于得到dom对象的文档元素，并把获得的对象给root

每一个结点都有它的nodeName，nodeValue，nodeType属性。

nodeName为结点名字。

nodeValue是结点的值，只对文本结点有效。

nodeType是结点的类型。catalog是ELEMENT_NODE类型

现在有以下几种：

'ATTRIBUTE_NODE'

'CDATA_SECTION_NODE'

'COMMENT_NODE'

'DOCUMENT_FRAGMENT_NODE'

'DOCUMENT_NODE'

'DOCUMENT_TYPE_NODE'

'ELEMENT_NODE'

'ENTITY_NODE'

'ENTITY_REFERENCE_NODE'

'NOTATION_NODE'

'PROCESSING_INSTRUCTION_NODE'

'TEXT_NODE'

三、获得子标签

现在要获得catalog的子标签以的标签name

复制代码代码如下:

?xml version="1.0" encoding="utf-8"?

catalog

maxid4/maxid

captionPython/caption

item id="4"

caption测试/caption

/item

/login

item id="2"

captionZope/caption

/item

/catalog

对于知道元素名字的子元素，可以使用getElementsByTagName方法获取：

复制代码代码如下:

#coding=utf-8

import xml.dom.minidom

#打开xml文档

dom = xml.dom.minidom.parse('abc.xml')

#得到文档元素对象

root = dom.documentElement

bb = root.getElementsByTagName('maxid')

b= bb[0]

print b.nodeName

bb = root.getElementsByTagName('login')

b= bb[0]

print b.nodeName

如何区分相同标签名字的标签：

复制代码代码如下:

?xml version="1.0" encoding="utf-8"?

catalog

maxid4/maxid

captionPython/caption

item id="4"

caption测试/caption

/item

/login

item id="2"

captionZope/caption

/item

/catalog

caption和item标签不止一个如何区分？

复制代码代码如下:

#coding=utf-8

import xml.dom.minidom

#打开xml文档

dom = xml.dom.minidom.parse('abc.xml')

#得到文档元素对象

root = dom.documentElement

bb = root.getElementsByTagName('caption')

b= bb[2]

print b.nodeName

bb = root.getElementsByTagName('item')

b= bb[1]

print b.nodeName

root.getElementsByTagName('caption') 获得的是标签为caption 一组标签，b[0]表示一组标签中的第一个；b[2] ，表示这一组标签中的第三个。

四、获得标签属性值

复制代码代码如下:

?xml version="1.0" encoding="utf-8"?

catalog

maxid4/maxid

captionPython/caption

item id="4"

caption测试/caption

/item

/login

item id="2"

captionZope/caption

/item

/catalog

login和item标签是有属性的，如何获得他们的属性？

复制代码代码如下:

#coding=utf-8

import xml.dom.minidom

#打开xml文档

dom = xml.dom.minidom.parse('abc.xml')

#得到文档元素对象

root = dom.documentElement

itemlist = root.getElementsByTagName('login')

item = itemlist[0]

un=item.getAttribute("username")

print un

pd=item.getAttribute("passwd")

print pd

ii = root.getElementsByTagName('item')

i1 = ii[0]

i=i1.getAttribute("id")

print i

i2 = ii[1]

i=i2.getAttribute("id")

print i

getAttribute方法可以获得元素的属性所对应的值。

五、获得标签对之间的数据

复制代码代码如下:

?xml version="1.0" encoding="utf-8"?

catalog

maxid4/maxid

captionPython/caption

item id="4"

caption测试/caption

/item

/login

item id="2"

captionZope/caption

/item

/catalog

caption标签对之间是有数据的，如何获得这些数据？

获得标签对之间的数据有多种方法，

方法一：

复制代码代码如下:

#coding=utf-8

import xml.dom.minidom

#打开xml文档

dom = xml.dom.minidom.parse('abc.xml')

#得到文档元素对象

root = dom.documentElement

cc=dom.getElementsByTagName('caption')

c1=cc[0]

print c1.firstChild.data

c2=cc[1]

print c2.firstChild.data

c3=cc[2]

print c3.firstChild.data

firstChild 属性返回被选节点的第一个子节点，.data表示获取该节点人数据。

方法二：

复制代码代码如下:

#coding=utf-8

from xml.etree import ElementTree as ET

per=ET.parse('abc.xml')

p=per.findall('./login/item')

for oneper in p:

for child in oneper.getchildren():

print child.tag,':',child.text

p=per.findall('./item')

for oneper in p:

for child in oneper.getchildren():

print child.tag,':',child.text

方法二有点复杂，所引用模块也与前面的不一样，findall用于指定在哪一级标签下开始遍历。

getchildren方法按照文档顺序返回所有子标签。并输出标签名（child.tag）和标签的数据（child.text）

其实，方法二的作用不在于此，它核心功能是可以遍历某一级标签下的所有子标签。

python和xml简介的简单介绍

python读取xml文件有哪些方法

1、以下几种方法建议初学者使用：

xml.etree.ElementTree

xml.dom

xml.dom.minidom

xml.dom.pulldom

xml.parsers.expat

其中，第一个模块更加轻便简介，对于简单的xml文档，推荐使用

下面的方法涉及知识比较多，熟练掌握上面方法后可以了解使用：

2、Dom读取

3、Dom4j读取

使用dom4j需要导入相关的jar包

import java.io.File;

import java.util.Iterator;

import java.util.List;

4、JDom读取

使用jdom需要导入相关的jar包

import java.io.FileInputStream;

import java.io.InputStream;

5、Sax读取

6、properties的读取

geojson合并python的简单介绍

本文目录一览： 1、Geojson笔记二：geojson-python-util 2、python 合并两个json文件 3、怎么样用Python实现地理编码 4、如何生成geojson格式的tile

2023-12-08

python学习之笔记（python的笔记）

2022-11-10

python修改xml中内容的简单介绍

2022-11-16

我的python笔记06（Python）

2022-11-14

python使用turtle库的简单介绍

2022-11-18

python操作xml创建网站的简单介绍

2022-11-11

python中的轴axis的简单介绍

2022-11-12

javascript入门笔记1的简单介绍

2022-11-18

python笔记二（2python）

2022-11-11

python对csv的操作的简单介绍

2022-11-11

python判断是否json的简单介绍

本文目录一览： 1、python怎么判断json 字符串含有某一个字符 2、python json快速解析命令 3、py3笔记8：json结构的校验 4、python json 资料判断 true 或

2023-12-08

第1章python简介（python第一章笔记）

2022-11-10

python图像识别时钟的简单介绍

2022-11-09

python实现图的bfs遍历的简单介绍

2022-11-15

简单粗暴的实现python的简单介绍

2022-11-10

Windows 软件

Linux 软件

Mac 软件

安卓软件

各类文章

python和xml简介的简单介绍

本文目录一览：

python 解析xml需要什么模块

用python怎么操作xml文件内容

python读取xml文件有哪些方法

python和xml简介的简单介绍

python使用笔记23的简单介绍

python更改xml的简单介绍

重拾python笔记三的简单介绍

python使用笔记006的简单介绍

geojson合并python的简单介绍

python学习之笔记（python的笔记）

python修改xml中内容的简单介绍

我的python笔记06（Python）

python使用turtle库的简单介绍

python操作xml创建网站的简单介绍

python中的轴axis的简单介绍

javascript入门笔记1的简单介绍

python笔记二（2python）

python对csv的操作的简单介绍

python判断是否json的简单介绍

第1章python简介（python第一章笔记）

python图像识别时钟的简单介绍

python实现图的bfs遍历的简单介绍

简单粗暴的实现python的简单介绍

Windows 软件

Linux 软件

Mac 软件

安卓软件

各类文章

python和xml简介的简单介绍

本文目录一览：

python 解析xml需要什么模块

用python怎么操作xml文件内容

python读取xml文件有哪些方法

python和xml简介的简单介绍

python使用笔记23的简单介绍

python更改xml的简单介绍

重拾python笔记三的简单介绍

python使用笔记006的简单介绍

geojson合并python的简单介绍

python学习之笔记（python的笔记）

python修改xml中内容的简单介绍

我的python笔记06（Python）

python使用turtle库的简单介绍

python操作xml创建网站的简单介绍

python中的轴axis的简单介绍

javascript入门笔记1的简单介绍

python笔记二（2python）

python对csv的操作的简单介绍

python判断是否json的简单介绍

第1章python简介（python第一章笔记）

python图像识别时钟的简单介绍

python实现图的bfs遍历的简单介绍

简单粗暴的实现python的简单介绍

人机检测，请谅解