pythonminidom

发布时间: 2022-06-11 22:26:06

⑴ python 如何使用minidom解析xml消息

response返回的xml格式是错误的，xml内容的第一行 <？xml version="1.0"？> 使用了中文符号？，将其改为英文的?即可。

⑵ python 解析xml需要什么模块

Python的标准库中，提供了6种可以用于处理XML的包。

（1）xml.dom

xml.dom实现的是W3C制定的DOM API。如果你习惯于使用DOM API或者有人要求这这样做，可以使用这个包。不过要注意，在这个包中，还提供了几个不同的模块，各自的性能有所区别。

DOM解析器在任何处理开始之前，必须把基于XML文件生成的树状数据放在内存，所以DOM解析器的内存使用量完全根据输入资料的大小。

（2）xml.dom.minidom

xml.dom.minidom是DOM API的极简化实现，比完整版的DOM要简单的多，而且这个包也小的多。那些不熟悉DOM的朋友，应该考虑使用xml.etree.ElementTree模块。据lxml的作者评价，这个模块使用起来并不方便，效率也不高，而且还容易出现问题。

相关推荐：《Python教程》

（3）xml.dom.pulldom

与其他模块不同，xml.dom.pulldom模块提供的是一个“pull解析器”，其背后的基本概念指的是从XML流中pull事件，然后进行处理。虽然与SAX一样采用事件驱动模型（event-driven processing model），但是不同的是，使用pull解析器时，使用者需要明确地从XML流中pull事件，并对这些事件遍历处理，直到处理完成或者出现错误。

pull解析（pull parsing）是近来兴起的一种XML处理趋势。此前诸如SAX和DOM这些流行的XML解析框架，都是push-based，也就是说对解析工作的控制权，掌握在解析器的手中。

（4）xml.sax

xml.sax模块实现的是SAX API，这个模块牺牲了便捷性来换取速度和内存占用。SAX是Simple API for XML的缩写，它并不是由W3C官方所提出的标准。它是事件驱动的，并不需要一次性读入整个文档，而文档的读入过程也就是SAX的解析过程。所谓事件驱动，是指一种基于回调（callback）机制的程序运行方法。

（5）xml.parser.expat

xml.parser.expat提供了对C语言编写的expat解析器的一个直接的、底层API接口。expat接口与SAX类似，也是基于事件回调机制，但是这个接口并不是标准化的，只适用于expat库。

expat是一个面向流的解析器。您注册的解析器回调（或handler）功能，然后开始搜索它的文档。当解析器识别该文件的指定的位置，它会调用该部分相应的处理程序（如果您已经注册的一个）。该文件被输送到解析器，会被分割成多个片断，并分段装到内存中。因此expat可以解析那些巨大的文件。

（6）xml.etree.ElementTree（以下简称ET）

xml.etree.ElementTree模块提供了一个轻量级、Pythonic的API，同时还有一个高效的C语言实现，即xml.etree.cElementTree。与DOM相比，ET的速度更快，API使用更直接、方便。与SAX相比，ET.iterparse函数同样提供了按需解析的功能，不会一次性在内存中读入整个文档。ET的性能与SAX模块大致相仿，但是它的API更加高层次，用户使用起来更加便捷。

建议：在使用Python进行XML解析时，首选使用ET模块，除非你有其他特别的需求，可能需要另外的模块来满足。

⑶ 如何用python读取xml文件

一、简介

XML（eXtensible Markup Language）指可扩展标记语言，被设计用来传输和存储数据，已经日趋成为当前许多新生技术的核心，在不同的领域都有着不同的应用。它是web发展到一定阶段的必然产物，既具有SGML的核心特征，又有着HTML的简单特性，还具有明确和结构良好等许多新的特性。
python解析XML常见的有三种方法：一是xml.dom.*模块，它是W3C DOM API的实现，若需要处理DOM API则该模块很适合，注意xml.dom包里面有许多模块，须区分它们间的不同；二是xml.sax.*模块，它是SAX API的实现，这个模块牺牲了便捷性来换取速度和内存占用，SAX是一个基于事件的API，这就意味着它可以“在空中”处理庞大数量的的文档，不用完全加载进内存；三是xml.etree.ElementTree模块（简称 ET），它提供了轻量级的Python式的API，相对于DOM来说ET 快了很多，而且有很多令人愉悦的API可以使用，相对于SAX来说ET的ET.iterparse也提供了 “在空中” 的处理方式，没有必要加载整个文档到内存，ET的性能的平均值和SAX差不多，但是API的效率更高一点而且使用起来很方便。
二、详解

解析的xml文件（country.xml）：
在CODE上查看代码片派生到我的代码片

<?xml version="1.0"?>
<data>
<country name="Singapore">
<rank>4</rank>
<year>2011</year>
<gdppc>59900</gdppc>
<neighbor name="Malaysia" direction="N"/>
</country>
<country name="Panama">
<rank>68</rank>
<year>2011</year>
<gdppc>13600</gdppc>
<neighbor name="Costa Rica" direction="W"/>
<neighbor name="Colombia" direction="E"/>
</country>
</data>

1、xml.etree.ElementTree

ElementTree生来就是为了处理XML，它在Python标准库中有两种实现：一种是纯Python实现的，如xml.etree.ElementTree，另一种是速度快一点的xml.etree.cElementTree。注意：尽量使用C语言实现的那种，因为它速度更快，而且消耗的内存更少。
在CODE上查看代码片派生到我的代码片

try:
import xml.etree.cElementTree as ET
except ImportError:
import xml.etree.ElementTree as ET

这是一个让Python不同的库使用相同API的一个比较常用的办法，而从Python 3.3开始ElementTree模块会自动寻找可用的C库来加快速度，所以只需要import xml.etree.ElementTree就可以了。
在CODE上查看代码片派生到我的代码片

#!/usr/bin/evn python
#coding:utf-8

try:
import xml.etree.cElementTree as ET
except ImportError:
import xml.etree.ElementTree as ET
import sys

try:
tree = ET.parse("country.xml") #打开xml文档
#root = ET.fromstring(country_string) #从字符串传递xml
root = tree.getroot() #获得root节点
except Exception, e:
print "Error:cannot parse file:country.xml."
sys.exit(1)
print root.tag, "---", root.attrib
for child in root:
print child.tag, "---", child.attrib

print "*"*10
print root[0][1].text #通过下标访问
print root[0].tag, root[0].text
print "*"*10

for country in root.findall('country'): #找到root节点下的所有country节点
rank = country.find('rank').text #子节点下节点rank的值
name = country.get('name') #子节点下属性name的值
print name, rank

#修改xml文件
for country in root.findall('country'):
rank = int(country.find('rank').text)
if rank > 50:
root.remove(country)

tree.write('output.xml')

运行结果：

三、总结
（1）Python中XML解析可用的类库或模块有xml、libxml2 、lxml 、xpath等，需要深入了解的还需参考相应的文档。
（2）每一种解析方式都有自己的优点和缺点，选择前可以综合各个方面的性能考虑。
（3）若有不足，请留言，在此先感谢！

⑷ Python过滤关键词怎么做呢，在线等

你直接in就可以了

filter_words=['aaa','bbb','ccc']
test='afewfjlkkbbbsdfewfe'

forwinfilter_words:
ifwintest:
print"error"
break

如果解决了您的问题请采纳！
如果未解决请继续追问

⑸ python读取xml文件有哪些方法

引入XML组件：import xml.dom.minidom。
创建一个xml文件，<?xml version="1.0" encoding="utf-8"?>。
相关推荐：《Python教程》
加载读取XML文件，xml.dom.minidom.parse('abc.xml')，这是xml文件的对象。
获取XML文档对象，root = dom.documentElement。
获取标签之间的数据，rootdata.getElementsByTagName('caption')。
总结一下xml对象，node.getAttribute(AttributeName)，获取XML节点属性值，node.getElementsByTagName(TagName)，获取XML节点对象集合，等等具体的查看手册。

⑹ python xml.dom.minidom 操作xml, 删除节点的问题

这个你用正则表达式吧，某一个结点的注释不能通过工具找

⑺ python2 自带xml.dom.minidom吗

python2.x版本自带xml.dom.minidom

使用 import xml.dom.minidom 导入即可

⑻ Python xml.dom.minidom保存时出错

def clear_format(self,fp)
from re import sub as resub

fp=resub('\n','',fp)
fp=resub('\t','',fp)
fp=resub('\s+',' ',fp)
fp=resub('>\s+<','><',fp)
newxml=Dom.parseString(fp)
newfp = newxml.toprettyxml().strip()
return newfp

def __save(self):
with open("Person.xml","w",encoding=self.__doc.encoding) as f:
f=self.clear_format(f)

self.__doc.writexml(f,encoding=self.__doc.encoding)

⑼ python xml.dom.minidom.parse

这个函数不是只打开文件，而是读取整个文件的内容到内存，然后关掉文件。

想释放读取到内存的dom节点，可以调用unlink()函数

示例：

dom1=parse('c:\temp\mydata.xml')
dom1.unlink()

另外，python是有自动内存回收的。如果一个dom节点变量不再被使用，也会自动释放。

⑽ Python：如何过滤特殊字符和乱码的字符

如果是从Html文本弄来的，那直接download Html的源代码，然后直接替换其中的<div class="">这里是随机字符串</div>

Python里面使用xml.minidom就OK

阅读全文

热点内容

scratch少儿编程课程发布：2025-04-16 17:11:44 浏览：619

荣耀x10从哪里设置密码发布：2025-04-16 17:11:43 浏览：347

java从入门到精通视频发布：2025-04-16 17:11:43 浏览：62

php微信接口教程发布：2025-04-16 17:07:30 浏览：288

android实现阴影发布：2025-04-16 16:50:08 浏览：781

粉笔直播课缓存发布：2025-04-16 16:31:21 浏览：334

机顶盒都有什么配置发布：2025-04-16 16:24:37 浏览：197

编写手游反编译都需要学习什么发布：2025-04-16 16:19:36 浏览：791

proteus编译文件位置发布：2025-04-16 16:18:44 浏览：350

土压缩的本质发布：2025-04-16 16:13:21 浏览：578

pythonminidom

与pythonminidom相关的资讯