2、正则表达式匹配器详解

正则表达式匹配器详解

1. 正则表达式概述

正则表达式是用于描述文本模式的符号,实际上构成了一种用于模式匹配的专用语言。大多数模式中的字符匹配其自身的字面出现,但一些元字符有特殊含义,例如 * 表示某种重复, [...] 表示方括号内集合中的任意一个字符。

在实际应用中,像文本编辑器这类程序的大多数搜索是针对字面单词的,所以正则表达式常常是像 print 这样的字面字符串,它可以匹配 printf sprint printer paper 等。在 Unix 和 Windows 用于指定文件名的通配符中, * 匹配任意数量的字符,所以模式 *.c 匹配所有以 .c 结尾的文件名。正则表达式有许多变体,即使在人们期望它们相同的上下文中也是如此。

正则表达式由 Stephen Kleene 在 20 世纪 50 年代中期发明,作为有限自动机的符号。实际上,它们在表示的内容上与有限自动机等价。它们最早出现在 20 世纪 60 年代中期 Ken Thompson 版本的 QED 文本编辑器的程序设置中。1967 年,Thompson 申请了一项基于正则表达式的快速文本匹配机制的专利,该专利于 1971 年获得批准,这是最早的软件专利之一。

正则表达式从 QED 发展到 Unix 编辑器 ed ,然后到经典的 Unix 工具 grep

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值