Python-常用正则

一、数字:
1 数字:^[0-9]*$ 或 ^\d+$

2 n位的数字:^\d{n}$

3 至少n位的数字:^\d{n,}$

4 m-n位的数字:^\d{m,n}$

5 零和非零开头的数字:^(0|[1-9][0-9]*)$

6 非零开头的最多带两位小数的数字:^([1-9][0-9])+(.[0-9]{1,2})?$ 或 ^[1-9]\d.\d{0,2}$

7 带1-2位小数的正数或负数:^(-)?\d+(.\d{1,2})?$ 或 ^(-)?\d*.\d{0,2}$

8 正数、负数、和小数:^(-|+)?\d+(.\d+)?$

re.search(r’^(-|+)?\d*.\d+$’,’+50.32’)
<_sre.SRE_Match object; span=(0, 6), match=’+50.32’>

9 有两位小数的正实数:^[0-9]+(.[0-9]{2})?$ 或 ^\d*.\d{2}$

re.search(r’^\d*.\d{2}$’,‘50.32’)
<_sre.SRE_Match object; span=(0, 5), match=‘50.32’>

re.search(r’^[0-9]+(.[0-9]{2})?$’,‘50.32’)
<_sre.SRE_Match object; span=(0, 5), match=‘50.32’>

10 有1~3位小数的正实数:^[0-9]+(.[0-9]{1,3})?$ 或 ^\d+.\d{1,3}$

re.search(r’^\d*.\d{1,3}$’,‘50.32’)
<_sre.SRE_Match object; span=(0, 5), match=‘50.32’>

re.search(r’^\d+.\d{1,3}$’,‘50.323’)
<_sre.SRE_Match object; span=(0, 6), match=‘50.323’>

11 非零的正整数:^[1-9]\d*$ 或 ^([1-9][0-9]){1,3}$ 或 ^+?[1-9][0-9]$ 或 ^[1-9]\d*$

re.search(r’^[1-9]\d*$’,‘5’)
<_sre.SRE_Match object; span=(0, 1), match=‘5’>

re.search(r’^([1-9][0-9]*){1,3}$’,‘5’)
<_sre.SRE_Match object; span=(0, 1), match=‘5’>

re.search(r’^+?[1-9][0-9]*$’,‘5’)
<_sre.SRE_Match object; span=(0, 1), match=‘5’>

12 非零的负整数:^-[1-9][0-9]$ 或 ^-[1-9]\d$

re.search(r’^-[1-9][0-9]*$’,’-5’)
<_sre.SRE_Match object; span=(0, 2), match=’-5’>

re.search(r’^-[1-9]\d*$’,’-5’)
<_sre.SRE_Match object; span=(0, 2), match=’-5’>

13 非负整数:^\d+$ 或 ^[1-9]\d*|0$

re.search(r’^[1-9]\d*|0$’,‘5’)
<_sre.SRE_Match object; span=(0, 1), match=‘5’>

re.search(r’^[1-9]\d*|0$’,‘0’)
<_sre.SRE_Match object; span=(0, 1), match=‘0’>

14 非正整数:^-[1-9]\d*|0$ 或 ^((-\d+)|(0+))$
<_sre.SRE_Match object; span=(0, 1), match=‘0’>

re.search(r’^-[1-9]\d*|0$’,’-55’)
<_sre.SRE_Match object; span=(0, 3), match=’-55’>

re.search(r’^((-\d+)|(0+))$’,’-55’)
<_sre.SRE_Match object; span=(0, 3), match=’-55’>

15 非负浮点数:^\d+(.\d+)?$ 或 ^[1-9]\d*.\d*|0.\d*[1-9]\d*|0?.0+|0$

16 非正浮点数:^((-\d+(.\d+)?)|(0+(.0+)?))$ 或 ^(-([1-9]\d*.\d*|0.\d*[1-9]\d*))|0?.0+|0$

17 正浮点数:^[1-9]\d*.\d*|0.\d*[1-9]\d*$
或 ^(([0-9]+.[0-9][1-9][0-9])|([0-9][1-9][0-9].[0-9]+)|([0-9][1-9][0-9]))$

18 负浮点数:^-([1-9]\d*.\d*|0.\d*[1-9]\d*)$
或 ^(-(([0-9]+.[0-9][1-9][0-9])|([0-9][1-9][0-9].[0-9]+)|([0-9][1-9][0-9])))$

19 浮点数:^(-?\d+)(.\d+)?$ 或 ^-?([1-9]\d*.\d*|0.\d*[1-9]\d*|0?.0+|0)$

二、校验字符的表达式

1 汉字:^[\u4e00-\u9fa5]{0,}$

re.search(r’^[\u4e00-\u9fa5]{0,}$’,‘你’)
<_sre.SRE_Match object; span=(0, 1), match=‘你’>

2 英文和数字:^[A-Za-z0-9]+$ 或 ^[A-Za-z0-9]{4,40}$

3 长度为3-20的所有字符:^.{3,20}$

4 由26个英文字母组成的字符串:^[A-Za-z]+$

5 由26个大写英文字母组成的字符串:^[A-Z]+$

6 由26个小写英文字母组成的字符串:^[a-z]+$

7 由数字和26个英文字母组成的字符串:^[A-Za-z0-9]+$

8 由数字、26个英文字母或者下划线组成的字符串:^\w+$ 或 ^\w{3,20}$

re.search(r’^\w+$’,‘a32at_g55’)
<_sre.SRE_Match object; span=(0, 9), match=‘a32at_g55’>

9 中文、英文、数字包括下划线:^[\u4E00-\u9FA5A-Za-z0-9_]+$

10 中文、英文、数字但不包括下划线等符号:^[\u4E00-\u9FA5A-Za-z0-9]+$ 或 ^[\u4E00-\u9FA5A-Za-z0-9]{2,20}$

11 可以输入含有^%&’,;=?KaTeX parse error: Can't use function '\"' in math mode at position 1: \̲"̲等字符:[^%&',;=?\x22]+

12 禁止输入含有的字符:[^\x22]+
13 匹配空行的正则表达式:n[s| ]r
14 匹配HTML标记的正则表达式:/<(.
)>.</1>|<(.) />/
15 匹配首尾空格的正则表达式:(^s*)|(s*$)
16 匹配所有键盘上可见的非字母和数字的符号 ((?=[\x21-\x7e]+)[^A-Za-z0-9])

三、特殊需求表达式

1)Email地址:
^\w+([-+.]\w+)@\w+([-.]\w+).\w+([-.]\w+)*$

邮箱:
(([<>()\[\]\\.,;:\s@"]+(\.[^<>()\[\]\\.,;:\s@"]+)*)|(".+"))@((\[[0-9]{1,3}\.[0-9]{1,3}\.[0-9]{1,3}\.[0-9]{1,3}])|(([a-zA-Z\-0-9]+\.)+[a-zA-Z]{2,}))$

2)域名:
[a-zA-Z0-9][-a-zA-Z0-9]{0,62}(/.[a-zA-Z0-9][-a-zA-Z0-9]{0,62})+/.?

3)InternetURL:
[a-zA-z]+://[^\s]* 或 ^http://([\w-]+.)+[\w-]+(/[\w-./?%&=]*)?$

4)Ip地址
\b(???:25[0-5]|2[0-4][0-9]|[01]?[0-9][0-9]?).){3}(?:25[0-5]|2[0-4][0-9]|[01]?[0-9][0-9]?)\b
5)网页的所有链接
“http.*?”
6)手机号码最新:
^((13[0-9])|(14[5,7])|(15[0-3,5-9])|(17[0,3,5-8])|(18[0-9])|166|198|199|(147))\d{8}$(java)

^((13[0-9])|(14[5,7])|(15[0-3,5-9])|(17[0,3,5-8])|(18[0-9])|166|198|199|(147))\d{8}$(js或jq)

7)电话号码
(“XXX-XXXXXXX”、“XXXX-XXXXXXXX”、“XXX-XXXXXXX”、“XXX-XXXXXXXX”、"XXXXXXX"和"XXXXXXXX):^((\d{3,4}-)|\d{3.4}-)?\d{7,8}$

8)国内电话号码
(0511-4405222、021-87888822):\d{3}-\d{8}|\d{4}-\d{7}

9)身份证号(15位、18位数字):
^\d{15}|\d{18}$

10)短身份证号码(数字、字母x结尾):
^([0-9]){7,18}(x|X)?$ 或 ^\d{8,18}|[0-9x]{8,18}|[0-9X]{8,18}?$

11)帐号是否合法(字母开头,允许5-16字节,允许字母数字下划线):
1[a-zA-Z0-9_]{4,15}$

12)密码
(以字母开头,长度在6~18之间,只能包含字母、数字和下划线):
2\w{5,17}$

13)强密码
(必须包含大小写字母和数字的组合,不能使用特殊字符,长度在8-10之间):
^(?=.\d)(?=.[a-z])(?=.*[A-Z]).{8,10}$

14)日期格式:
^\d{4}-\d{1,2}-\d{1,2}

15)一年的12个月(01~09和1~12):
^(0?[1-9]|1[0-2])$

16)一个月的31天(01~09和1~31):
^((0?[1-9])|((1|2)[0-9])|30|31)$

17)匹配时间格式:
([0-1]\d|2[0-3]):[0-5]\d:[0-5]\d

18)钱的输入格式:

(1).有四种钱的表示形式我们可以接受:"10000.00" 和 "10,000.00", 和没有 "分" 的 "10000" 和 "10,000":^[1-9][0-9]*$

(2).这表示任意一个不以0开头的数字,但是,这也意味着一个字符"0"不通过,所以我们采用下面的形式:^(0|[1-9][0-9]*)$

(3).一个0或者一个不以0开头的数字.我们还可以允许开头有一个负号:^(0|-?[1-9][0-9]*)$

(4).这表示一个0或者一个可能为负的开头不为0的数字.让用户以0开头好了.把负号的也去掉,因为钱总不能是负的吧.下面我们要加的是说明可能的小数部分:^[0-9]+(.[0-9]+)?$

(5).必须说明的是,小数点后面至少应该有1位数,所以"10."是不通过的,但是 "10" 和 "10.2" 是通过的:^[0-9]+(.[0-9]{2})?$

(6).这样我们规定小数点后面必须有两位,如果你认为太苛刻了,可以这样:^[0-9]+(.[0-9]{1,2})?$

(7).这样就允许用户只写一位小数.下面我们该考虑数字中的逗号了,我们可以这样:^[0-9]{1,3}(,[0-9]{3})*(.[0-9]{1,2})?$

(8).1到3个数字,后面跟着任意个 逗号+3个数字,逗号成为可选,而不是必须:^([0-9]+|[0-9]{1,3}(,[0-9]{3})*)(.[0-9]{1,2})?$

19)xml文件:
^([a-zA-Z]±?)+[a-zA-Z0-9]+\.[x|X][m|M][l|L]$

20)中文字符的正则表达式:
[\u4e00-\u9fa5]

21)双字节字符:
[^\x00-\xff] (包括汉字在内,可以用来计算字符串的长度(一个双字节字符长度计2,ASCII字符计1))

22)空白行的正则表达式:
\n\s*\r (可以用来删除空白行)

23)HTML标记的正则表达式:
<(\S*?)[^>]>.?</\1>|<.*? /> (网上流传的版本太糟糕,上面这个也仅仅能部分,对于复杂的嵌套标记依旧无能为力)

24)首尾空白字符的正则表达式:
^\s*|\s*KaTeX parse error: Expected group after '^' at position 3: 或(^̲\s*)|(\s*) (可以用来删除行首行尾的空白字符(包括空格、制表符、换页符等等),非常有用的表达式)

25)腾讯QQ号:
[1-9][0-9]{4,} (腾讯QQ号从10000开始)

26)中国邮政编码:
[1-9]\d{5}(?!\d) (中国邮政编码为6位数字)
27) IP地址:\d+.\d+.\d+.\d+ (提取IP地址时有用)


  1. a-zA-Z ↩︎

  2. a-zA-Z ↩︎

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值