WS07-Re(正则表达式)库入门
来源:互联网 发布:通过intent传递数据 编辑:程序博客网 时间:2024/06/06 01:34
1、正则表达式是用来简洁表达一组字符串的表达式
正则表达式是一种通用的字符串表达框架
正则表达式是一种针对字符串表达“简洁”和“特征”思想的工具
正则表达式可以用来判断某字符串的特征归属
2、
. 表示任何单个字符
[ ] 字符集,对单个字符给出取值范围 [abc]表示a、b、c,[a‐z]表示a到z单个字符
[^ ] 非字符集,对单个字符给出排除范围 [^abc]表示非a或b或c的单个字符
* 前一个字符0次或无限次扩展 abc* 表示 ab、abc、abcc、abccc等
+ 前一个字符1次或无限次扩展 abc+ 表示 abc、abcc、abccc等
? 前一个字符0次或1次扩展 abc? 表示 ab、abc
| 左右表达式任意一个 abc|def 表示 abc、def
操作符 说明 实例
{m} 扩展前一个字符m次 ab{2}c表示abbc
{m,n} 扩展前一个字符m至n次(含n) ab{1,2}c表示abc、abbc
^ 匹配字符串开头 ^abc表示abc且在一个字符串的开头
( ) 分组标记,内部只能使用 | 操作符 (abc)表示abc,(abc|def)表示abc、def
\d 数字,等价于[0‐9]
\w 单词字符,等价于[A‐Za‐z0‐9_]
3、
raw string类型(原生字符串类型)
re库采用raw string类型表示正则表达式,表示为:
r’text’
例如: r’[1‐9]\d{5}’
r’\d{3}‐\d{8}|\d{4}‐\d{7}’
raw string是不包含对转义符再次转义的字符串
4、
re.search() 在一个字符串中搜索匹配正则表达式的第一个位置,返回match对象
re.match() 从一个字符串的开始位置起匹配正则表达式,返回match对象
re.findall() 搜索字符串,以列表类型返回全部能匹配的子串
re.split() 将一个字符串按照正则表达式匹配结果进行分割,返回列表类型
re.finditer() 搜索字符串,返回一个匹配结果的迭代类型,每个迭代元素是match对象
re.sub() 在一个字符串中替换所有匹配正则表达式的子串,返回替换后的字符串
5、贪婪匹配与最小匹配
match = re.search(r'PY.*N', 'PYANBNCNDN')>>> match.group(0)'PYANBNCNDN'
Re库默认采用贪婪匹配,即输出匹配最长的子串
如何输出最短的子串呢?
>>> match = re.search(r'PY.*?N', 'PYANBNCNDN')>>> match.group(0)'PYAN'
*? 前一个字符0次或无限次扩展,最小匹配
+? 前一个字符1次或无限次扩展,最小匹配
?? 前一个字符0次或1次扩展,最小匹配
{m,n}? 扩展前一个字符m至n次(含n),最小匹配
- WS07-Re(正则表达式)库入门
- 爬虫---正则表达式:re库
- Python标准库 正则表达式 (re包)
- Python标准库re正则表达式
- re库正则表达式常用操作符
- python爬虫之re正则表达式库
- [笔记]python爬虫:正则表达式库re
- 4、认识正则表达式和re库
- Python 正则表达式 re
- python-re【正则表达式】
- re正则表达式
- 正则表达式re模块
- python re 正则表达式
- Python re正则表达式
- python 正则表达式 re
- 正则表达式(RE)
- RE正则表达式
- Python正则表达式(re)
- 2017最新Kotlin快速入门进阶
- IntelliJ IDEA使用手册——更改字体和颜色
- php数组与xml的相互转化
- mysql基础
- 信用经济时代:考验人品的时候到了!
- WS07-Re(正则表达式)库入门
- html学习之控制背景图片大小
- RabbitMQ各种交换机类型Exchange Types介绍
- linux环境tomcat安装
- Tekla.Structures.v2017i.SP1 1DVD
- BZOJ1119: [POI2009]SLO
- Java基础_红黑树
- Android recyclerView的拖动
- 利用ps生成闪电特效