正则基础知识点

倾徵

于 2022-04-21 00:36:33 发布

阅读量382

点赞数

分类专栏：笔记文章标签： javascript

本文链接：https://blog.csdn.net/qq_50988574/article/details/124310860

版权

笔记专栏收录该内容

11 篇文章 0 订阅

订阅专栏

本文详细介绍了正则表达式的各个方面，包括基础语法、元字符、字符类、量词、分组、边界匹配、断言以及正则属性和方法。学习目标包括掌握正则基本语法、编写常见正则表达式和理解匹配规则。文中还提到了各种工具和实例，帮助读者更好地理解和运用正则表达式进行字符串操作。

摘要由CSDN通过智能技术生成

正则

学习目标

掌握正则基本语法
会编写常见的正则表达式
能看懂正则表达是匹配规则
已知规则可以编写正则表达是

正则工具

[正则使用工具] (http://regexper.com )

[正则入门] (https://www.jb51.net/tools/zhengze.html)

正则是什么

正则是运算符。作用用于查询字符串

修饰符

g: 全局匹配
可以匹配到 0-多个结果
i: 匹配大小写
m 多行匹配

元字符

正则表达式有两种基本字符 元字符 原义文本字符

原义概念：表示代表本来文本的字符；
元字符：再正则表达式中有特殊意义的字符

.* + ? $ ^ | \ () {} [] \n \d \w \r\ Q \f \b \cX…

[]  或  字符类；将一堆字符放在一个字符类中，匹配结果为一个字符。字符长度有量词决定
{}  量词  作用；决定匹配字符的长度。每个正则字符值匹配一个字符；量词决定结果字符长度0-n.
() 
.
+
*
?
^
$
\b
\d  匹配0-9随机字符
\w
\n
\r
\f

字符类[]

一般情况下，一个字符对应一个字符串
作用：匹配的一类字符。
相当于：或

普通类

特殊：需要配【某类】字符

1：使用[]来构建简单的类
2：所谓的类是指符合某些特性的对象；一个泛指；而不是特定某个字符

例如[abc] 匹配 a或 b 或 c 中其中一类就可以

字符类取反 [^]

1：使用**^** 创建反向类必须在**[^]** 内
2：不属于某类 /[^abc]/ —> [^abc] 非 a b c

范围类

1:[a-z] 匹配 a-z 任意字符，闭意区间表示包含a z 本身】
2:在 [] 主城的类可以连写 [a-zA-Z]
3[0-9]

预定义类

作用：匹配常见的字符

. [^\r\n] 任意字符除了回车和换行的
\d [0-9]
\s [’ '] 匹配空格字符
\S 匹配非空格字符
\w [a-zA-Z0-9_]

总结：字符类，一般用户查询字符。匹配字符。
字符串删除查询更改，适合使用字符类。
正则；只是辅助完成，找到删除更新的字符

边界匹配的字符

^ 开头 ¹{4}
$ 结尾
\b 单词边界
\B 非单词边界

总结：用于验证某个字符串是否满足某个规则
规则：需求一定确定的
规则：特别严格

量词

量词：是匹配一个字符的长度多少？
匹配一个连续出现20次的字符；字符长度为20
? 出现0次或者1次 /\d{0,1}/ /\d?/

一次或者多次 {1,}

出现0次或者多次 {0,}
{n} 长度为n
{n,m} 长度最小n 最大m
{n,} 长度为n到无穷大

注意：以上匹配方式都是，长度尽量多的匹配特点

量词：解决的匹配的字符串长度

贪婪模式非贪婪模式

\d{3，6} 贪婪模式尽可能多的匹配
\d{3,6}? 非贪婪模式；尽可能少的匹配

分组 ()

需求：
yyc{3} —> c3次
(yyc){3} —> yyc 连续3次出现次数

或 |

多个分支走任意一个分支都可以
(yyc|wjr) yyc或者wjr

反项引用

$1$2$3 捕获分组中的内容

忽略分组

不想捕获某个分组时候，在分前后面加上?:就可以了
例如：(?:yyc) 不会捕获到yyc

前瞻

正则表达式从头到尾的解析文本尾部叫做【前】文本头部叫做后
1：前瞻就是正则表达式匹配到规则时候；向前价查是否符合【断言】，后顾/后瞻方向相反
2：js不支持后顾
3：符合和不符合特定断言叫做肯定/正向匹配；和否定/负向匹配
正向匹配：既要符合正则也要符合断言 exp(?=assert); exp规则部分（?=assert）断言部分.

例如 \w(?=\d) 匹配到\w 后还要往后看看是不是数字

负向匹配 exp(?!assert)

正向前瞻往后看断言，负向前瞻往前看断言

断言

正则表达式中的条件判断

(?=pattern) 正向先行断言(正向肯定)
代表字符串中的一个位置，紧接该位置之后的字符序列能够匹配pattern(规则)。
例如对”a regular expression”这个字符串，要想匹配regular中的re，但不能匹配expression中的re，可以用”re(?=gular)”，该表达式限定了re右边的位置，这个位置之后是gular，但并不消耗gular这些字符，将表达式改为”re(?=gular).”，将会匹配reg，元字符.匹配了g，括号这一砣匹配了e和g之间的位置。
(?!pattern) 负向先行断言(正向否定)
代表字符串中的一个位置，紧接该位置之后的字符序列不能匹配pattern。
例如对”regex represents regular expression”这个字符串，要想匹配除regex和regular之外的re，可以用”re(?!g)”，该表达式限定了re右边的位置，这个位置后面不是字符g。负向和正向的区别，就在于该位置之后的字符能否匹配括号中的表达式。
(?<=pattern) 正向后行断言(反向肯定断言)
代表字符串中的一个位置，紧接该位置之前的字符序列能够匹配pattern。
例如对”regex represents regular expression”这个字符串，有4个单词，要想匹配单词内部的re，但不匹配单词开头的re，可以用”(?<=\w)re”，单词内部的re，在re前面应该是一个单词字符。之所以叫后行断言，是因为正则表达式引擎在匹配字符串和表达式时，是从前向后逐个扫描字符串中的字符，并判断是否与表达式符合，当在表达式中遇到该断言时，正则表达式引擎需要往字符串前端检测已扫描过的字符，相对于扫描方向是向后的。
(?<!pattern) 负向后行断言(负向否定断言)
代表字符串中的一个位置，紧接该位置之前的字符序列不能匹配pattern。
例如对”regex represents regular expression”这个字符串，要想匹配单词开头的re，可以用”(?<!\w)re”。单词开头的re，在本例中，也就是指不在单词内部的re，即re前面不是单词字符。当然也可以用”\bre”来匹配。

总结上面的断言

1：断言中正则不匹配字符
2：断言中正则是限定匹配字符的条件
- 正向—>肯定
- 负向—>否定
3：断言表示字符中的一个位置
- 后行 —> 之前 —> 左侧位置
- 先行 —> 之后 —> 右侧位置

正则属性

1: global 是否是全局搜索；默认false
2：ignore case: 是否对忽略大小写默认false
3：multiline 多行搜索默认false
4: lastIndex 当前表达式匹配内容的最后一个字符的下一个字符
5：source 正则表达式文本字符

正则方法

reg.test(str)
作用检测是否有匹配到的结果
返回: true false
reg.exec(str)
exec() 方法检索字符串中的指定值。如果没有发现匹配，
则返回 null。返回值是被找到的值结果为数组。
- index 声明匹配文本第一个字符的位置
- input 存放被检索的字符串

非全局调用

调用非全局的RegExp 对象中exce 返回一个数组
第一个元素式正则表达式匹配的文本
第二个元素式与 RegExpObject 的第一个字表达式（第一个分组）匹配的文本
第三个元素式与RegExp 对象的第二个子表达式相匹配的文本（第二个分组）

var reg = /\d(\w)\d/
var reg1  = /\d(\w)\d/g;
var str = '1a2b3c3d5e';
var res = reg.exec(str)

console.log(reg.lastIndex+'\t'+res.index+res.toString());
console.log(reg1.lastIndex+'\t'+res.index+res.toString());
console.log(reg1.lastIndex+'\t'+res.index+res.toString());

正则表达式查询手册

字符	描述
\	将下一个字符标记为一个特殊字符、或一个原义字符、或一个向后引用、或一个八进制转义符。例如，“n”匹配字符“n”。“\n”匹配一个换行符。串行“\”匹配“\”而“(”则匹配“(”。^
^	匹配输入字符串的开始位置。如果设置了RegExp对象的Multiline属性，^也匹配“`\n`”或“`\r`”之后的位置。
$	匹配输入字符串的结束位置。如果设置了RegExp对象的Multiline属性，$也匹配“`\n`”或“`\r`”之前的位置。
*	匹配前面的子表达式零次或多次。例如，zo能匹配“`z`”以及“`zoo`”。等价于{0,}。
+	匹配前面的子表达式一次或多次。例如，“`zo+`”能匹配“`zo`”以及“`zoo`”，但不能匹配“`z`”。+等价于{1,}。
?	匹配前面的子表达式零次或一次。例如，“`do(es)?`”可以匹配“`does`”或“`does`”中的“`do`”。?等价于{0,1}。
{n}	n是一个非负整数。匹配确定的n次。例如，“`o{2}`”不能匹配“`Bob`”中的“`o`”，但是能匹配“`food`”中的两个o。
{n,}	n是一个非负整数。至少匹配n次。例如，“`o{2,}`”不能匹配“`Bob`”中的“`o`”，但能匹配“`foooood`”中的所有o。“`o{1,}`”等价于“`o+`”。“`o{0,}`”则等价于“`o*`”。
{n,m}	m和n均为非负整数，其中n<=m。最少匹配n次且最多匹配m次。例如，“`o{1,3}`”将匹配“`fooooood`”中的前三个o。“`o{0,1}`”等价于“`o?`”。请注意在逗号和两个数之间不能有空格。
?	当该字符紧跟在任何一个其他限制符（*,+,?，{n}，{n,}，{n,m}）后面时，匹配模式是非贪婪的。非贪婪模式尽可能少的匹配所搜索的字符串，而默认的贪婪模式则尽可能多的匹配所搜索的字符串。例如，对于字符串“`oooo`”，“`o+?`”将匹配单个“`o`”，而“`o+`”将匹配所有“`o`”。
.	匹配除“`\``n`”之外的任何单个字符。要匹配包括“`\``n`”在内的任何字符，请使用像“`(.
(pattern)	匹配pattern并获取这一匹配。所获取的匹配可以从产生的Matches集合得到，在VBScript中使用SubMatches集合，在JScript中则使用$0…$9属性。要匹配圆括号字符，请使用“`$`”或“`$`”。
(?:pattern)	匹配pattern但不获取匹配结果，也就是说这是一个非获取匹配，不进行存储供以后使用。这在使用或字符“`(
(?=pattern)	正向肯定预查，在任何匹配pattern的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。例如，“`Windows(?=95
(?!pattern)	正向否定预查，在任何不匹配pattern的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。例如“`Windows(?!95
(?<=pattern)	反向肯定预查，与正向肯定预查类拟，只是方向相反。例如，“`(?<=95
(?<!pattern)	反向否定预查，与正向否定预查类拟，只是方向相反。例如“`(?”能匹配“`3.1Windows`”中的“`Windows`”，但不能匹配“`2000Windows`”中的“`Windows`”。
x\|y	y匹配x或y。例如，“`z