正则表达式随摘

 

普通文字和符号:A-Z a-z 0-9 以及不是元字符的其它符号

输入Unicode字符时,同String一样,使用\uXXXX

元字符:三三二三个一(记忆口诀)

三个括号: {[(

三个匹配次数: *+? 星加问

两个断言: ^$ 定头定尾

三个一: | 选择符 . 模糊匹配 \ 转义

三个括号:

{定义匹配次数

[字符集

(子模式

三个匹配次数:

* 匹配出现0次或多次

+ 匹配出现至少1次或多次

? 匹配出现0次最多1次

两个断言:

^ 在/后出现时为左端断言, /^

$ 在/前出现时为右端断言, $/

三个独立元字符:

| 选择符,匹配时兼容匹配选择符两边的字符

. 模糊匹配,可以代替

不可见字符:比较一些转义的控制字符

14.3.2 正则表达式中的字符集

1.字符集的概念和最简单的字符集形式

[字符集]

字符集用中括号括起来

Unicode字符请使用\uXXXX 四位十六进制Unicode代码输入

如:/g[eo]t,分别匹配get和got,但不会匹配geot,因为字符集只能匹配一个字符

2.连字符在字符集中的运用

[字符-字符]

如:[a-z][A-Z],就是匹配英文字母字符集了

3.取反符号在字符集中的运用

[^字符集]

添加取反符号后,匹配时将忽略字符集中的所有元素

4.字符集中需要转义的特殊字符

\转义符号

常见要转义的字符有三类:

1.字符串: 双引号” 单引号 ‘ 反斜杠 \

2.正则表达式的源字符

3.字符集中的: [\^-

尽可能将会产生歧义的字符转义

14.3.3 特殊的点号(.)

.号可以替代任意单个字符,作为正则表达式中的模糊匹配字符

1.点号不匹配新行符(\n)

多行字符的模糊匹配中,.号不能匹配\n换行符,要匹配换行符,必须在标志位中使用s

2.尽量少使用点号“.”

只在明确不会模糊匹配时出错的情况下才用.模糊匹配,点号匹配所有的Unicode字符。

14.3.4 选择符

| 对选择符两边的元素作任意匹配。

使用|选择符时,尽可能使用括号将两边的操作数括起来,以方便区别。

14.3.5 括号与分组

() 圆括号将表达式的一部分括起来,就会将这部分定交成组,一旦命名了组,就可以通过“向后引用”来调用它。

它所括起的部分一般用于:

1.和选择符搭配,规定作用于选择符的范围,如/he(got|get)it/

2.和限定符搭配使用,指定匹配的重复次数,如/(get)*/

14.3.6 用正则表达式描述字符串的重复

使用{}定义匹配的重复次数,跟在要重复的表达式或字符后面

{最小出现次数[,最多出现次数]}

还有常用的三个 非显式限定符

*+? 星加问

* 出现0次或多次 等同 {0,}

+ 出现1次或多次 等同 {1,}

? 出现0次或最多1次 等同 {0,1}

14.3.7 注意正则表达式的贪婪性和懒惰性

使用*+?{}的时候,正则表达式总是尽可能向右搜寻尽可能多的匹配结果,如果想禁止此贪婪性,可在操作符后加上 ?,迫使程序运行时使用懒惰模式,优先使用左边匹配的第一个结果。

14.3.8 用正则表达式来定位

断言:指定匹配发生的位置

^ 匹配字符串起始的位置,一般跟在起始/后,组合成 /^

$ 匹配字符串结尾的位置,一般跟在结束/前,组合成$/

\b 匹配字符边界

\B 匹配非字符边界

字符边界指空格的位置,可跟在要匹配的表达式左边或右边

14.3.9 正则表达式的5个标志位。

g global 全局匹配,尽可能匹配全部结果

i ignoreCase 不区分大小写匹配

m multiline 断言控制符,使用后 ^$两个断言符才能生效

s dotall 匹配换行符标志

x extended 令正则表达式支持空格,但编译时会自动忽略,增加可视的友好度

14.3.10 正则表达式元字符优先线

优先级顺序从高到低排列

\ 转义符

(),(?:),(?=),[] 分级定义符号,字符集定义符号

*,+,?,{n},{n,},{n,m} 限定符

^,$,\位置定义 位置和顺序

| 选择符

14.4 正则表达式与字符串的结合使用详解

14.4.1 RegExp的exec()和test()

test方法

var RegExp对象:RegExp = /正则表达式/ 或 new RegExp(正则式,标志位)

var String对象:String = 字符;

RegExp对象.test(String对象)

RegExp对象.exec(正则表达式):Array

exec返回一个匹配后的数组

14.4.3 String类的replace()与正则表达式向后引用

()使用子表达式括起的表达式,可以在后边引用 ,使用\n n为索引 从1至99

/\b([a-z]+) \1\b/gi 其中的\1就是引用前面第一个([a-z])

可在处理函数中用 $n 来引用子模式

 


评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值