Python正则表达式

最新推荐文章于 2021-12-20 16:44:49 发布

walxiaosage

最新推荐文章于 2021-12-20 16:44:49 发布

阅读量465

点赞数 1

CC 4.0 BY-SA版权

分类专栏： Python入门学习

本文链接：https://blog.youkuaiyun.com/walxiaosage/article/details/50418380

Python入门学习专栏收录该内容

38 篇文章

订阅专栏

Python正则表达式

1.正则表达式re模块

1.re模块使用（1）

1）import re:python 正则表达式模块

2）第一个正则表达式

使用情况举例：

import re

str='imooc python'

pa=re.compile(r'imooc')#中间的参数就是匹配的内容

#此时就生成了一个pattern的实例。通过。tab可以查看所有的方法

ma=pa.match(str1)#ma也是一个对象，他的值放在group等相关方法，ma.span()就可以查看匹配的位置

#ma.string（）保存被匹配的字符串

print ma

pa=re.compile(r'imooc',re.IGNORECASE)#匹配时候可以忽略大小写

ma.groups()#匹配的返回值的元组

ma=re.match(r'imooc',str1)#此时这种方式其实现是一样的

2.正则表达式语法

1. 正则表达式语法—单个字符（1）

字符	匹配
.	匹配任意字符（除了\n）两个就两个..
[…]	匹配字符集 [] 中的任意一个字符
\d / \D	匹配数字/非数字
\s / \S	匹配空白/ 非空白
\w/ \W	匹配单词字符【a-Za-Z0-9】/ 非单词字符

import re

ma=re.match(r'.','a')#匹配任意一个非\n的字符

ma=re.match(r'{.}','a{bd}')#匹配大括号中间任意字符

ma=re.match(r'{[abd]}','{abde}')#匹配abd中任何一个字符就可以

mma=re.match(r'{[a-z]}','{abde}')#匹配a-z中任何一个字符就可以

ma=re.match(r'{[a-zA-Z0-9]}','{abde}')#匹配a-z,A-Z,0-9中任何一个字符就可以

ma=re.match(r'[\w]','{abde}')#效果同上

#如果想匹配[]作为边界的字符串呢？

# ma=re.match(r'[[\w]]','{abde}') 表达是无效的

ma=re.match(r'\[[\w]\]') #添加转移就可以了

2. 正则表达式语法—多个字符（2）

符号	匹配
*	匹配前一个字符0次或者无限次
+	匹配前一个字符1次或者无限次
?	匹配前一个字符0次或者1次
{m}/{m,n}	匹配前一个字符m次或者n次
*? / +? /??	模式匹配变为非贪婪（尽可能少匹配字符）

import re

#匹配以大写字母开头，后接小写字母0次或者无限次A-Z+a-z0-+

re.match(r'[A-Z][a-z]*','Asjdk')

# 匹配有效的python的变量名，以下划线或者字母开头

re.match(r'[_a-zA-Z]+[_\w]*','_name')

#匹配所有0-99之前的数字

re.match(r'[1-9]?[0-9]','99')#但是输入09也是匹配的

#匹配qq邮箱

re.match(r'[a-zA-Z0-9]{6}','ABC123')#可以匹配

re.match(r'[a-zA-Z0-9]{6}','ABC1')#匹配不成功

re.match(r'[a-zA-Z0-9]{6}','ABC11234')#匹配前6位

re.match(r'[a-zA-Z0-9]{6,10}@163.com','ABC11234')#匹配163邮箱

re.match(r'[0-9][a-z]*','1ab')#匹配结果为 1ab

re.match(r'[0-9][a-z]*?','1ab')#匹配结果为 1

re.match(r'[0-9][a-z]+?','1ab')#匹配结果为 1a

re.match(r'[0-9][a-z]??','1ab')#匹配结果为 1

3. 正则表达式语法—边界匹配（3）

字符	匹配
^	匹配字符串开头
$	匹配字符串结尾
\A / \Z	指定的字符串必须出现在开头/结尾

import re

#re.match(r'[a-zA-Z0-9]{6,10}@163.com','imooc@163.comagd')#也是可以匹配

re.match(r'^[\w]{6,10}@163.com$','imooc@163.comagd')#这样就完全匹配了

#如果指定的字符串必须出现在字符串开头或者结尾呢，如指定必须以imooc开头

re.match(r'\Aimooc[\w]*','imoocpython')#可以匹配，但是 iimooc就不匹配了

分组匹配：

字符	匹配
\|	匹配左右任意一个表达式
（ab）	括号中表达式作为一个分组
\<number>	引用编号为num的分组匹配到的字符串
（？P<name>）	分组起一个别名
（？P=name）	引用别名为name的分组匹配字符串