python中的re模块

发布时间: 2024-08-09 06:26:36

❶ python 中 re.sub 和 re.compile 是啥意思呀跪求大神解释。

在python中re是一个常用的模块，主要是通过正则表达式进行字符串处理。它的速度相对自己用 find, replace, split来说，通常更快。当然功能更强大。

正则表达式也是一种语言，所以如果通过re.compile把它编译成对象，会速度快很多。所以我们经常看到这样的语句

exp=re.compile("S+")
m=exp.search(bigtext)
printm.group(0)

这段话等同于

m=re.search("S+",bigtext)
printm.group(0)

re.sub则相当于字符串操作中的replace，比如

sometext=re.sub("(?isu)
","
",sometext)

上面这句话是将回车换行，变成换行。这是为了将windows下的文本文件移到linux下，防止某些软件不兼容所做的处理。

简单的说re.sub是做字符串替换的， re.compile是将正则表达式编译成一个对象，加快速度，并重复使用。

❷ 强烈推荐！Python 这个宝藏库 re 正则匹配

Python 的 re 模块（Regular Expression 正则表达式）提供各种正则表达式的匹配操作。

在文本解析、复杂字符串分析和信息提取时是一个非常有用的工具 ，下面总结了 re 模块的常用方法。

d 匹配所有的十进制数字 0-9

D 匹配所有的非数字，包含下划线

s 匹配所有空白字符（空格、TAB等）

S 匹配所有非空白字符，包含下划线

w 匹配所有字母、汉字、数字 a-z A-Z 0-9

W 匹配所有非字母、汉字、数字，包含下划线

备注迹凳：符号.* 贪婪，符号.*? 非贪婪

[abc]：能匹配其中的单个字符

[a-z0-9]：能匹配指定范围的字符，可取反（在最前面加入^）

[2-9] [1-3]：能够做组合匹配

4.{ }：用于标记前面的字符出现的频率，有如下情况：

{n，m}：代表前面字符最少出现n次，最多出现m次

{n，}：代表前面字符最少出现n次，最多不受限制

{，m}：代表前面字符最多出现n次，最少不受限制

{n}：前面的字符必须出现n次

字符串中有反斜杠的，需要对反斜杠做转义

()：分组字符，可以为匹配到的内容分组，快速获取到分组中的数据在正则里面 "()" 代表的是分组的意思，一个括号代表一个分组，你只能匹配到 "()" 中的内容。

group：用于查看指定分组匹配到的内容

groups：返回一个元组，组内为所有匹配到的内容

groupdict：返回一个字典，包含分组的键值对，需要为分组命名

作用：可以将字符串匹配正则表达式的部分割开并返回一个列表

flags定义包括：

re.I：忽略大小写

re.L：表示特殊字符集 w, W, b, B, s, S 依赖于当前环境

re.M：多行模式

re.S：’.’并且包括换行符在内的任意字符（注意：’.’不包括换行符）

re.U：表示特殊字符集 w, W, b, B, d, D, s, S 依赖于 Unicode 字符属性数据库

在 Python 中使用正耐孙则表达式之前，先使用以下命令导入 re 模块

例如：

‘(d)(a)1’ 表示：匹配第一是数字，第二是字符a，第三 1 必须匹配第一个一样的数字重复一次姿亩旅，也就是被引用一次。

如 “9a9” 被匹配，但 “9a8” 不会被匹配，因为第三位的 1 必须是 9 才可以。

‘(d)(a)2’ 表示：匹配第一个是一个数字，第二个是a，第三个 2 必须是第二组（）中匹配一样的。

如 “8aa” 被匹配，但 “8ab”，“7a7” 不会被匹配，第三位必须是第二组字符的复制版，也是就引用第二组正则的匹配内容。

❸ Python模块的几种类型简介

view plain to clipboardprint?
import os
import stat
import time<DIV></DIV>

fileStats = os.stat ( 'test.txt' )
fileInfo = {
'Size' : fileStats [ stat.ST_SIZE ],
'LastModified' : time.ctime ( fileStats [ stat.ST_MTIME ] ),
'LastAccessed' : time.ctime ( fileStats [ stat.ST_ATIME ] ),
'CreationTime' : time.ctime ( fileStats [ stat.ST_CTIME ] ),
'Mode' : fileStats [ stat.ST_MODE ]
}

for infoField, infoValue in fileInfo:
print infoField, ':' + infoValue
if stat.S_ISDIR ( fileStats [ stat.ST_MODE ] ):
print 'Directory. '
else:
print 'Non-directory.'

import os
import stat
import time

fileStats = os.stat ( 'test.txt' )
fileInfo = {
'Size' : fileStats [ stat.ST_SIZE ],
'LastModified' : time.ctime ( fileStats [ stat.ST_MTIME ] ),
'LastAccessed' : time.ctime ( fileStats [ stat.ST_ATIME ] ),
'CreationTime' : time.ctime ( fileStats [ stat.ST_CTIME ] ),
'Mode' : fileStats [ stat.ST_MODE ]
}

for infoField, infoValue in fileInfo:
print infoField, ':' + infoValue
if stat.S_ISDIR ( fileStats [ stat.ST_MODE ] ):
print 'Directory. '
else:
print 'Non-directory.'

❹ Python re模块正则表达式之compile函数

为了重复利用同一个正则对象，需要多次使用这个正则表达式的话，使用re.compile()保存这个正则对象以便复用，可以让程序更加高效。

1）re.compile

参数：

re.I 忽略大小写

re.L 表示特殊字符集 w, W, b, B, s, S 依赖于当前环境

re.M 多行模式

re.S 即为' . '并且包括换行符在内的任意字符（' . '不包括换行符）

re.U 表示特殊字符集 w, W, b, B, d, D, s, S 依赖于 Unicode 字符属性数据库

re.X 为了增加可读性，忽略空格和' # '后面的注释

案例：

在上面，当匹配成功时返回一个 Match 对象，其中：

2）re.findall

在字符串中找到正则表达式所匹配的所有子串，并返回一个列表，如果有多个匹配模式，则返回元组列表，如果没有找到匹配的，则返回空列表。

注意： match 和 search 是匹配一次 findall 匹配所有。

参数：

案例：

3）re.finditer

和 findall 类似，在字符串中找到正则表达式所匹配的所有子串，并把它们作为一个迭代器返回。

案例：

4）re.split

split 方法按照能够匹配的子串将字符串分割后返回列表。

案例：

从上篇Python re模块正则表达式到这篇，我们已经把常用的正则匹配的方法学会了。

关注我，坚持每日积累一个技巧，长期坚持，我们将会不断进步。

#python# #程序员# #请回答，你的年度知识点# #教育听我说# #计算机#

阅读全文

热点内容

脚本模拟鼠标点击发布：2025-04-03 12:06:19 浏览：317

老安卓接口是什么发布：2025-04-03 11:57:31 浏览：761

nginx资源服务器搭建发布：2025-04-03 11:44:52 浏览：406

安卓开发和嵌入式哪个难发布：2025-04-03 11:25:09 浏览：318

ftp链接本地虚拟机发布：2025-04-03 11:25:02 浏览：793

手机扣扣怎么找回密码发布：2025-04-03 11:24:17 浏览：222

安卓平板上做记事本哪个好用发布：2025-04-03 11:21:27 浏览：865

android图片的大小发布：2025-04-03 11:20:08 浏览：469

我的世界电脑版服务器怎么tp别人发布：2025-04-03 11:20:08 浏览：911

sql指定记录发布：2025-04-03 11:19:59 浏览：287

python中的re模块

与python中的re模块相关的资讯