小白学爬虫笔记10---正则表达式入门

本文介绍了正则表达式的概念及应用,详细解释了各种操作符的功能,并通过多个实例展示了如何利用正则表达式进行字符串匹配,适用于初学者快速掌握正则表达式的基本用法。

正则表达式

regular expression regex RE

优势-简洁

例1:

  • 'py'
  • 'pyy'
  • 'pyyy'
    正则表达式 py+

例2

  • 'pyabc'
  • 'pykxyz'
    正则表达式:py[^py]{0,10}

 

正则表达式

  • 通用的字符串表达框架
  • 简洁表达一组字符串的表达式
  • 针对字符串表达“简洁”和“特征”思想的工具
  • 判断某字符串的特征归属

应用:主要在字符串匹配中

  • 表达文本的特征(病毒、入侵等)
  • 同事查找或替换一组字符串
  • 匹配字符串的全部或部分

 

  1. 编译:将符合正则表达式语法的字符串转换成正则表达式特征

 

正则表达式的常用操作符

  • . 表示任何单个字符
  • [] 字符集,对单个字符给出取值范围
  • [^ ] 非字符集,对单个字符给出排除范围
  • * 前一个字符0次或无限次扩展
  • + 前一个字符1次或无限次扩展
  •  前一个字符0次或1次扩展
  • | 左右表达式任意一个
  • {m} 扩展前一个字符m次
  • {m,n} 扩展前一个字符m至n此(含n)
  • ^ 匹配字符串开头
  • $ 匹配字符串结尾
  • () 分组标记,内部只能使用|操作符
  • \d 数字,等价于[0-9]
  • \w 单词字符,等价于[A-Za-z0-9]

 

例子

P(Y|YT|YTH|YTHO)?N: PN\PYN\PYTHN\PYTHON
PYTHON+: PYTHON\'PYTHONN'\PYTHONNN
PY[TH]ON:PYTON\PYHON
PY[^TH]?ON:PYON\PYaON\PYbON...
PY{:3}N:PN\PYN\PYYN\PYYYN

经典正则表达式

  • ^[A-Za-z]+$ 由26个字母组成的字符串
  • ^[A-Za-z0-9]+$ 由26个字母和数字组成的字符串
  • ^-\d+$ 整数
  • ^[0-9][1-9][0-9]$ 正整数
  • [1-9]\d{5} 中国境内邮政编码,6位
  • [\u4e00-\u9fa5] 匹配中文字符(utf-8)
  • \d{3}-\d{8}|d{4}-\d{7} 国内电话号码,010-68913536

匹配IP地址的正则表达式:分4段,每段0-255

\d+.\d+.\d+.\d+
\d{1,3}.\d{1,3).\d{1,3}.\d{1,3}
精确写法
0-99:[1-9]?\d
100-199:1\d{2}
200-249:2[0-4]\d
250-255:25[0-5]
应该是
(([1-9]?\d|1\d{2}|2[0-4]\d|25[0-5]).){3}([1-9]?\d|1\d{2}|2[0-4]\d|25[0-5])

## 软件功能详细介绍 1. **文本片段管理**:可以添加、编辑、删除常用文本片段,方便快速调用 2. **分组管理**:支持创建多个分组,不同类型的文本片段可以分类存储 3. **热键绑定**:为每个文本片段绑定自定义热键,实现一键粘贴 4. **窗口置顶**:支持窗口置顶功能,方便在其他应用程序上直接使用 5. **自动隐藏**:可以设置自动隐藏,减少桌面占用空间 6. **数据持久化**:所有配置和文本片段会自动保存,下次启动时自动加载 ## 软件使用技巧说明 1. **快速添加文本**:在文本输入框中输入内容后,点击"添加内容"按钮即可快速添加 2. **批量管理**:可以同时编辑多个文本片段,提高管理效率 3. **热键冲突处理**:如果设置的热键与系统或其他软件冲突,会自动提示 4. **分组切换**:使用分组按钮可以快速切换不同类别的文本片段 5. **文本格式化**:支持在文本片段中使用换行符和制表符等格式 ## 软件操作方法指南 1. **启动软件**:双击"大飞哥软件自习室——快捷粘贴工具.exe"文件即可启动 2. **添加文本片段**: - 在主界面的文本输入框中输入要保存的内容 - 点击"添加内容"按钮 - 在弹出的对话框中设置热键和分组 - 点击"确定"保存 3. **使用热键粘贴**: - 确保软件处于运行状态 - 在需要粘贴的位置按下设置的热键 - 文本片段会自动粘贴到当前位置 4. **编辑文本片段**: - 选中要编辑的文本片段 - 点击"编辑"按钮 - 修改内容或热键设置 - 点击"确定"保存修改 5. **删除文本片段**: - 选中要删除的文本片段 - 点击"删除"按钮 - 在确认对话框中点击"确定"即可删除
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
红包 添加红包
表情包 插入表情
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值