正则入门必备

最新推荐文章于 2023-04-04 23:41:31 发布

ice-index

最新推荐文章于 2023-04-04 23:41:31 发布

阅读量301

点赞数

分类专栏：正则文章标签：正则表达式

本文链接：https://blog.csdn.net/m0_65169658/article/details/124335452

版权

正则专栏收录该内容

1 篇文章 0 订阅

订阅专栏

正则

学习目标

掌握正则基本语法
会编写常见的正则表达式
能看懂正则表达是匹配规则
已知规则可以编写正则表达是

正则工具

正则使用工具

正则入门

正则是什么

正则是运算符。作用用于查询字符串

修饰符

g: 全局匹配
可以匹配到 0-多个结果
i: 不匹配大小写
m 多行匹配

元字符

正则表达式有两种基本字符 元字符 原义文本字符

原义概念：表示代表本来文本的字符；
元字符：再正则表达式中有特殊意义的字符

.* + ? $ ^ | \ () {} [] \n \d \w \r\ Q \f \b \cX…

[] 或字符类；将一堆字符放在一个字符类中，匹配结果为一个字符。字符长度有量词决定
{} 量词作用；决定匹配字符的长度。每个正则字符值匹配一个字符；量词决定结果字符长度0-n.
()

. 表示匹配的任意字符
+
*
?
^
$
\b
\d 匹配0-9随机字符
\w
\n
\r
\f

字符类[]

一般情况下，一个字符对应一个字符串

作用：匹配的一类字符。

相当于：或

普通类

特殊：需要配【某类】字符

1：使用[]来构建简单的类
2：所谓的类是指符合某些特性的对象；一个泛指；而不是特定某个字符

例如[abc] 匹配 a或 b 或 c 中其中一类就可以

字符类取反 [^]

1：使用** ^** 创建反向类必须在**[^]** 内
2：不属于某类 /[^abc]/
[^abc] 非 a b c

范围类

1:[a-z] 匹配 a-z 任意字符，闭意区间表示包含a z 本身】
2:在 [] 主城的类可以连写 [a-zA-Z]
3[0-9]

预定义类

作用：匹配常见的字符

. [^\r\n] 任意字符除了回车和换行的
\d [0-9]
\s [’ '] 匹配空格字符
\S 匹配非空格字符
\w [a-zA-Z0-9_]

总结：字符类，一般用户查询字符。匹配字符。

字符串删除查询更改，适合使用字符类。

正则；只是辅助完成，找到删除更新的字符

边界匹配的字符

^ 开头 ¹{4}
$ 结尾
\b 单词边界
\B 非单词边界

总结：用于验证某个字符串是否满足某个规则

规则：需求一定确定的

规则：特别严格。

量词

量词：是匹配一个字符的长度多少？
匹配一个连续出现20次的字符；字符长度为20
? 出现0次或者1次 /\d{0,1}/ /\d?/

一次或者多次 {1,}

出现0次或者多次 {0,}
{n} 长度为n
{n,m} 长度最小n 最大m
{n,} 长度为n到无穷大

注意：以上匹配方式都是，长度尽量多的匹配特点

量词：解决的匹配的字符串长度

贪婪模式非贪婪模式

\d{3，6} 贪婪模式尽可能多的匹配
\d{3,6}? 非贪婪模式；尽可能少的匹配

分组：

需求：撇需yyc 连续3次出现次数
yyc{3} c3次
(yyc){3}

1：小写英文字母数字练习出现3次、

或

多个分支走任意一个分支都可以
| 或
(yyc|wjr) yyc或者wjr

反项引用

RegExp.$1 读取分组中匹配到的内容

忽略分组

不想捕获某个分组时候，在分前后面加上?:就可以了
例如：
(?:yyc) 不会捕获到yyc

前zan瞻

正则表达式从头到尾的解析 文本尾部叫做**【前】** 文本头部叫做后****
1：前瞻就是正则表达式匹配到规则时候；向前价查是否符合【断言】，后顾/后瞻方向相反
2：js不支持后顾
3：符合和不符合特定断言叫做肯定/正向匹配**；和否定/负向匹配
正向匹配：既要符合正则也要符合断言 exp(?=assert); exp规则部分（?=assert）断言部分.

例如 **\w(?=\d) **匹配到\w 后还要往后看看是不是数字

负向匹配 exp(?!assert)

正向前瞻往后看断言，负向前瞻往前看断言

断言

正则表达式中的条件判断

(?=pattern) 正向先行断言（正向肯定）

代表字符串中的一个位置，紧接该位置之后的字符序列能够匹配pattern。

例如对”a regular expression”这个字符串，要想匹配regular中的re，但不能匹配expression中的re，可以用”re(?=gular)”，该表达式Z限定了re右边的位置Z，这个位置之后是gular，但并不消耗gular这些字符，将表达式改为”re(?=gular).”，将会匹配reg，元字符.匹配了g，括号这一砣匹配了e和g之间的位置。

(?!pattern) 负向先行断言（正向否定）

代表字符串中的一个位置，紧接该位置之后的字符序列不能匹配pattern。
例如对”regex represents regular expression”这个字符串，要想匹配除regex和regular之外的re，可以用”re(?!g)”，该表达式限定了re右边的位置，这个位置后面不是字符g。负向和正向的区别，就在于该位置之后的字符能否匹配括号中的表达式。

(?<=pattern) 正向后行断言（反向肯定断言）

代表字符串中的一个位置，紧接该位置之前的字符序列能够匹配pattern。

例如对”regex represents regular expression”这个字符串，有4个单词，要想匹配单词内部的re，但不匹配单词开头的re，可以用”(?<=\w)re”，单词内部的re，在re前面应该是一个单词字符。之所以叫后行断言，是因为正则表达式引擎在匹配字符串和表达式时，是从前向后逐个扫描字符串中的字符，并判断是否与表达式符合，当在表达式中遇到该断言时，正则表达式引擎需要往字符串前端检测已扫描过的字符，相对于扫描方向是向后的。

**(?<!pattern) **负向后行断言（反向否定断言）

代表字符串中的一个位置，紧接该位置之前的字符序列不能匹配pattern。
例如对”regex represents regular expression”这个字符串，要想匹配单词开头的re，可以用”(?<!\w)re”。单词开头的re，在本例中，也就是指不在单词内部的re，即re前面不是单词字符。当然也可以用”\bre”来匹配。

总结上面的断言

1：断言中正则不匹配字符
2：断言中正则是限定匹配字符的条件
- 正向—>肯定
- 负向—>否定
3：断言表示字符中的一个位置
- 后行 —>之前—>左边位置
- 先行—>之后—> 右边位置

正则属性

1: global 是否是全局搜索；默认false
2：ignore case: 是否对忽略大小写默认false
3：multiline 多行搜索默认false
4: lastIndex 当前表达式匹配内容的最后一个字符的下一个字符
5：source 正则表达式文本字符

正则方法

reg.test(str)
作用检测是否有匹配到的结果
reg.exec(str)
exec() 方法检索字符串中的指定值。如果没有发现匹配，
则返回 null。返回值是被找到的值结果为数组。
- index 声明匹配文本第一个字符的位置
- input 存放被检索的字符串

非全局调用

调用非全局的RegExp 对象中exce 返回一个数组
第一个元素式正则表达式匹配的文本
第二个元素式与 RegExpObject 的第一个字表达式（第一个分组）匹配的文本
第三个元素式与RegExp 对象的第二个子表达式相匹配的文本（第二个分组）

var reg = /\d(\w)\d/
var reg1  = /\d(\w)\d/g;
var str = '1a2b3c3d5e';
var res = reg.exec(str)

console.log(reg.lastIndex+'\t'+res.index+res.toString());
console.log(reg1.lastIndex+'\t'+res.index+res.toString());
console.log(reg1.lastIndex+'\t'+res.index+res.toString());

正则表达式查询手册

字符	描述
\	将下一个字符标记为一个特殊字符、或一个原义字符、或一个向后引用、或一个八进制转义符。例如，“n”匹配字符“n”。“\n”匹配一个换行符。串行“\”匹配“\”而“(”则匹配“(”。^
^	匹配输入字符串的开始位置。如果设置了RegExp对象的Multiline属性，^也匹配“`\n`”或“`\r`”之后的位置。
$	匹配输入字符串的结束位置。如果设置了RegExp对象的Multiline属性，$也匹配“`\n`”或“`\r`”之前的位置。
*	匹配前面的子表达式零次或多次。例如，zo能匹配“`z`”以及“`zoo`”。等价于{0,}。
+	匹配前面的子表达式一次或多次。例如，“`zo+`”能匹配“`zo`”以及“`zoo`”，但不能匹配“`z`”。+等价于{1,}。
?	匹配前面的子表达式零次或一次。例如，“`do(es)?`”可以匹配“`does`”或“`does`”中的“`do`”。?等价于{0,1}。
{n}	n是一个非负整数。匹配确定的n次。例如，“`o{2}`”不能匹配“`Bob`”中的“`o`”，但是能匹配“`food`”中的两个o。
{n,}	n是一个非负整数。至少匹配n次。例如，“`o{2,}`”不能匹配“`Bob`”中的“`o`”，但能匹配“`foooood`”中的所有o。“`o{1,}`”等价于“`o+`”。“`o{0,}`”则等价于“`o*`”。
{n,m}	m和n均为非负整数，其中n<=m。最少匹配n次且最多匹配m次。例如，“`o{1,3}`”将匹配“`fooooood`”中的前三个o。“`o{0,1}`”等价于“`o?`”。请注意在逗号和两个数之间不能有空格。
?	当该字符紧跟在任何一个其他限制符（*,+,?，{n}，{n,}，{n,m}）后面时，匹配模式是非贪婪的。非贪婪模式尽可能少的匹配所搜索的字符串，而默认的贪婪模式则尽可能多的匹配所搜索的字符串。例如，对于字符串“`oooo`”，“`o+?`”将匹配单个“`o`”，而“`o+`”将匹配所有“`o`”。
.	匹配除“`\``n`”之外的任何单个字符。要匹配包括“`\``n`”在内的任何字符，请使用像“`(.
(pattern)	匹配pattern并获取这一匹配。所获取的匹配可以从产生的Matches集合得到，在VBScript中使用SubMatches集合，在JScript中则使用$0…$9属性。要匹配圆括号字符，请使用“`$`”或“`$`”。
(?:pattern)	匹配pattern但不获取匹配结果，也就是说这是一个非获取匹配，不进行存储供以后使用。这在使用或字符“`(
(?=pattern)	正向肯定预查，在任何匹配pattern的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。例如，“`Windows(?=95
(?!pattern)	正向否定预查，在任何不匹配pattern的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。例如“`Windows(?!95
(?<=pattern)	反向肯定预查，与正向肯定预查类拟，只是方向相反。例如，“`(?<=95
(?<!pattern)	反向否定预查，与正向否定预查类拟，只是方向相反。例如“`(?”能匹配“`3.1Windows`”中的“`Windows`”，但不能匹配“`2000Windows`”中的“`Windows`”。
x\|y	y匹配x或y。例如，“`z

123 ↩︎

ice-index

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
正则入门必备

正则目录文章目录正则目录学习目标正则工具正则是什么修饰符元字符字符类[]普通类字符类取反 [^]范围类预定义类边界匹配的字符量词贪婪模式非贪婪模式分组：或反项引用忽略分组前zan瞻断言总结上面的断言正则属性正则方法非全局调用正则表达式查询手册学习目标掌握正则基本语法会编写常见的正则表达式能看懂正则表达是匹配规则已知规则可以编写正则表达是正则工具正则使用工具正则入门正则是什么正则是运算符。作用用于查询字符串修饰符g: 全局匹配可以匹配到 0-多个结果i: 不匹配大小
复制链接

扫一扫