实用的正则表达式

本文介绍了正则表达式的常用元字符,包括\d、\w等,并详细解释了+、*、?等重复限定符的使用方法。此外,还通过实例展示了如何使用这些元字符进行精确匹配,例如匹配合法的Python变量名及常用邮箱地址。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

一些常用的元字符:http://www.runoob.com/regexp/regexp-metachar.html


\d可以匹配一个数字
\w可以匹配一个字母或数字
.可以匹配任意字符(除\n)
如:'py.'可以匹配'pyc'、'pyo'、'py!'等等。


+ 代表前面的字符必须至少出现一次(1次或多次)
如:runoo+b,可以匹配 runoob、runooob、runoooooob 等


* 号代表字符可以不出现,也可以出现一次或者多次(0次、或1次、或多次)
如:runoo*b,可以匹配 runob、runoob、runoooooob 等


? 问号代表前面的字符最多只可以出现一次(0次、或1次)
如:colou?r 可以匹配 color 或者 colour


用{n}表示n个字符,用{n,}表示n~无穷个字符,用{n,m}表示n-m个字符


要做更精确地匹配,可以用[]表示字符集合,如:
[0-9a-zA-Z\_]可以匹配一个数字、字母或者下划线;
[0-9a-zA-Z\_]+可以匹配至少由一个数字、字母或者下划线组成的字符串,比如'a100','0_Z','Py3000'等等;
[a-zA-Z\_][0-9a-zA-Z\_]*可以匹配由字母或下划线开头,后接任意个由一个数字、字母或者下划线组成的字符串,也就是Python合法的变量;
[a-zA-Z\_][0-9a-zA-Z\_]{0,19}更精确地限制了变量的长度是1-20个字符(前面1个字符+后面最多19个字符)


A|B可以匹配A或B,所以(P|p)ython可以匹配'Python'或者'python',poj|noj匹配poj或者noj
^表示行的开头,^\d表示必须以数字开头。

$表示行的结束,\d$表示必须以数字结束。

练习:匹配一些常用邮箱:

(.+)@(qq|163|169)(\.com)


笔记来自廖雪峰python教程

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值