正则表达式入门|常见的js正则表达式

花花花菜

已于 2022-07-12 10:07:46 修改

阅读量208

点赞数 1

分类专栏： javascript 前端文章标签： javascript 前端

于 2022-04-01 10:39:23 首次发布

本文链接：https://blog.csdn.net/m0_59075169/article/details/123891826

版权

前端同时被 2 个专栏收录

26 篇文章 0 订阅

订阅专栏

javascript

16 篇文章 0 订阅

订阅专栏

正则

正则使用工具: http://regexper.com

正则入门：https://www.jb51.net/tools/zhengze.html

正则是什么

正则是运算符，作用用于查询字符串

修饰符

g: 全局匹配
可以匹配到 0-多个结果

i: 匹配大小写（不区分大小写）

m ：多行匹配

元字符

正则表达式有两种基本字符 元字符 原义文本字符
原义概念：表示代表本来文本的字符；
元字符：在正则表达式中有特殊意义的字符

.* + ? $ ^ | \ () {} [] \n \d \w \r\ Q \f \b \cX…

[] 或字符类；将一堆字符放在一个字符类中，匹配结果为一个字符。字符长度有量词决定
{} 量词作用；决定匹配字符的长度。每个正则字符值匹配一个字符；量词决定结果字符长度0-n.
() 分组
\u4E00-\u9FA5 ：匹配所有汉字，字符长度为1
var reg12 = /[\u4E00-\u9FA5]/g

. :匹配除“\n”之外的任何单个字符。

:匹配前面的子表达式一次或多次。

:匹配前面的子表达式零次或多次
? :当该字符紧跟在任何一个其他限制符（*,+,?，{n}，{n,}， {n,m}）后面时，匹配模式是非贪婪的。非贪婪模式尽可能少的匹配所搜索的字符串，而默认的贪婪模式则尽可能多的匹配所搜索的字符串。
^ :匹配输入字符串的开始位置。
$ :匹配输入字符串的结束位置。
\b :匹配一个单词边界，也就是指单词和空格间的位置。
\d : 匹配0-9随机字符串，字符长度为1与[]作用相同
\w : 匹配数字或字母或下划线
\n :匹配一个换行符。等价于\x0a和\cJ。
\r :匹配一个回车符。等价于\x0d和\cM。
\f :匹配一个换页符。等价于\x0c和\cL。

字符类[]

一般情况下，一个字符对应一个字符串
作用：匹配的一类字符，相当于或

普通类

特殊：需要配【某类】字符
1：使用[]来构建简单的类
2：所谓的类是指符合某些特性的对象；一个泛指；而不是特定某个字符
例如[abc] 匹配 a或 b 或 c 中其中一类就可以

字符类取反 [^]

1：使用**^** 创建反向类必须在[^] 内
2：不属于某类
[^abc] 非 a b c

范围类

1:[a-z] 匹配 a-z 任意字符
闭意区间表示包含a z 本身
2:在 [] 主城的类可以连写 [a-zA-Z]
3: [0-9 ]

预定义类

作用：匹配常见的字符
[^\r\n] 任意字符除了回车和换行的
\d [0-9]
\s [’ ‘] 匹配空格字符
\S [^’ '] 匹配非空格字符
\w [a-zA-Z0-9_]

总结：字符类，一般用于查询字符，匹配字符
字符串删除查询更改，适合使用字符类
正则：只是辅助完成，找到删除更新的字符

边界匹配的字符

^ 开头 ¹{4}
$ 结尾
\b 单词边界
\B 非单词边界

总结：用于验证某个字符串是否满足规则
规则：需求不一定确定的
规则:非常严格

量词

量词：是匹配一个字符的长度多少？
匹配一个连续出现20次的字符；字符长度为20
? 出现0次或者1次 /\d{0,1}/ /\d?/

一次或者多次 {1,}

出现0次或者多次 {0,}
{n} 长度为n
{n,m} 长度最小为n 最大为m
{n,} n到无穷大
注意：以上匹配方式都是，长度尽量多的匹配

量词：解决的匹配字符串长度

贪婪模式非贪婪模式

\d{3，6} 贪婪模式尽可能多的匹配

\d{3,6}? 非贪婪模式；尽可能少的匹配

分组：

需求：撇需yyc 连续3次出现次数
yyc{3} c3次
(yyc){3}

1：小写英文字母数字练习出现3次、

或

多个分支走任意一个分支都可以
| 或
(yyc|wjr) yyc或者wjr

反项引用

$1$2$3 捕获分组中的内容

忽略分组

不想捕获某个分组时候，在分前后面加上?:就可以了
例如：
(?:yyc) 不会捕获到yyc

前zan瞻

正则表达式从头到尾的解析文本尾部叫做【前】文本头部叫做后
1：前瞻就是正则表达式匹配到规则时候；向前价查是否符合【断言】，后顾/后瞻方向相反
2：js不支持后顾
3：符合和不符合特定断言叫做肯定/正向匹配；和否定/负向匹配
正向匹配：既要符合正则也要符合断言 exp(?=assert); exp规则部分（?=assert）断言部分.

例如 \w(?=\d) 匹配到\w 后还要往后看看是不是数字

负向匹配 exp(?!assert)

正向前瞻往后看断言，负向前瞻往前看断言

断言

(?=pattern) 正向先行断言
代表字符串中的一个位置，紧接该位置之后的字符序列能够匹配pattern。
例如对”a regular expression”这个字符串，要想匹配regular中的re，但不能匹配expression中的re，可以用”re(?=gular)”，该表达式限定了re右边的位置，这个位置之后是gular，但并不消耗gular这些字符，将表达式改为”re(?=gular).”，将会匹配reg，元字符.匹配了g，括号这一砣匹配了e和g之间的位置。

(?!pattern) 负向先行断言
代表字符串中的一个位置，紧接该位置之后的字符序列不能匹配pattern。
例如对”regex represents regular expression”这个字符串，要想匹配除regex和regular之外的re，可以用”re(?!g)”，该表达式限定了re右边的位置，这个位置后面不是字符g。负向和正向的区别，就在于该位置之后的字符能否匹配括号中的表达式。

(?<=pattern) 正向后行断言
代表字符串中的一个位置，紧接该位置之前的字符序列能够匹配pattern。
例如对”regex represents regular expression”这个字符串，有4个单词，要想匹配单词内部的re，但不匹配单词开头的re，可以用”(?<=\w)re”，单词内部的re，在re前面应该是一个单词字符。之所以叫后行断言，是因为正则表达式引擎在匹配字符串和表达式时，是从前向后逐个扫描字符串中的字符，并判断是否与表达式符合，当在表达式中遇到该断言时，正则表达式引擎需要往字符串前端检测已扫描过的字符，相对于扫描方向是向后的。

(?<!pattern)
代表字符串中的一个位置，紧接该位置之前的字符序列不能匹配pattern。
例如对”regex represents regular expression”这个字符串，要想匹配单词开头的re，可以用”(?<!\w)re”。单词开头的re，在本例中，也就是指不在单词内部的re，即re前面不是单词字符。当然也可以用”\bre”来匹配。

正则属性

1: global 是否是全局搜索；默认false
2：ignore case: 是否对忽略大小写默认false
3：multiline 多行搜索默认false
4: lastIndex 当前表达式匹配内容的最后一个字符的下一个字符
5：source 正则表达式文本字符

正则方法

reg.test(str)
作用检测是否有匹配到的结果
reg.exec(str)
exec() 方法检索字符串中的指定值。如果没有发现匹配，
则返回 null。返回值是被找到的值结果为数组。
- index 声明匹配文本第一个字符的位置
- input 存放被检索的字符串

非全局调用

调用非全局的RegExp 对象中exce 返回一个数组
第一个元素式正则表达式匹配的文本
第二个元素式与 RegExpObject 的第一个字表达式（第一个分组）匹配的文本
第三个元素式与RegExp 对象的第二个子表达式相匹配的文本（第二个分组）

var reg = /\d(\w)\d/
var reg1  = /\d(\w)\d/g;
var str = '1a2b3c3d5e';
var res = reg.exec(str)

console.log(reg.lastIndex+'\t'+res.index+res.toString());
console.log(reg1.lastIndex+'\t'+res.index+res.toString());
console.log(reg1.lastIndex+'\t'+res.index+res.toString());

正表达式查询手册

字符	描述
^	匹配输入字符串的开始位置。如果设置了RegExp对象的Multiline属性，^也匹配“`\n`”或“`\r`”之后的位置。
$	匹配输入字符串的结束位置。如果设置了RegExp对象的Multiline属性，$也匹配“`\n`”或“`\r`”之前的位置。
*	匹配前面的子表达式零次或多次。例如，zo能匹配“`z`”以及“`zoo`”。等价于{0,}。
+	匹配前面的子表达式一次或多次。例如，“`zo+`”能匹配“`zo`”以及“`zoo`”，但不能匹配“`z`”。+等价于{1,}。
?	匹配前面的子表达式零次或一次。例如，“`do(es)?`”可以匹配“`does`”或“`does`”中的“`do`”。?等价于{0,1}。
{n}	n是一个非负整数。匹配确定的n次。例如，“`o{2}`”不能匹配“`Bob`”中的“`o`”，但是能匹配“`food`”中的两个o。
{n,}	n是一个非负整数。至少匹配n次。例如，“`o{2,}`”不能匹配“`Bob`”中的“`o`”，但能匹配“`foooood`”中的所有o。“`o{1,}`”等价于“`o+`”。“`o{0,}`”则等价于“`o*`”。
{n,m}	m和n均为非负整数，其中n<=m。最少匹配n次且最多匹配m次。例如，“`o{1,3}`”将匹配“`fooooood`”中的前三个o。“`o{0,1}`”等价于“`o?`”。请注意在逗号和两个数之间不能有空格。
?	当该字符紧跟在任何一个其他限制符（*,+,?，{n}，{n,}，{n,m}）后面时，匹配模式是非贪婪的。非贪婪模式尽可能少的匹配所搜索的字符串，而默认的贪婪模式则尽可能多的匹配所搜索的字符串。例如，对于字符串“`oooo`”，“`o+?`”将匹配单个“`o`”，而“`o+`”将匹配所有“`o`”。
.	匹配除“`\``n`”之外的任何单个字符。要匹配包括“`\``n`”在内的任何字符，请使用像“`(.
(pattern)	匹配pattern并获取这一匹配。所获取的匹配可以从产生的Matches集合得到，在VBScript中使用SubMatches集合，在JScript中则使用$0…$9属性。要匹配圆括号字符，请使用“`$`”或“`$`”。
(?:pattern)	匹配pattern但不获取匹配结果，也就是说这是一个非获取匹配，不进行存储供以后使用。这在使用或字符“`(
(?=pattern)	正向肯定预查，在任何匹配pattern的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。例如，“`Windows(?=95
(?!pattern)	正向否定预查，在任何不匹配pattern的字符串开始处匹配查找字符串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后使用。例如“`Windows(?!95
(?<=pattern)	反向肯定预查，与正向肯定预查类拟，只是方向相反。例如，“`(?<=95
(?<!pattern)	反向否定预查，与正向否定预查类拟，只是方向相反。例如“`(?”能匹配“`3.1Windows`”中的“`Windows`”，但不能匹配“`2000Windows`”中的“`Windows`”。
x\|y	匹配x或y。例如，“`z
[xyz]	字符集合。匹配所包含的任意一个字符。例如，“`[abc]`”可以匹配“`plain`”中的“`a`”。
[^xyz]	负值字符集合。匹配未包含的任意字符。例如，“`[^abc]`”可以匹配“`plain`”中的“`p`”。
[a-z]	字符范围。匹配指定范围内的任意字符。例如，“`[a-z]`”可以匹配“`a`”到“`z`”范围内的任意小写字母字符。
[^a-z]	负值字符范围。匹配任何不在指定范围内的任意字符。例如，“`[^a-z]`”可以匹配任何不在“`a`”到“`z`”范围内的任意字符。
\b	匹配一个单词边界，也就是指单词和空格间的位置。例如，“`er\b`”可以匹配“`never`”中的“`er`”，但不能匹配“`verb`”中的“`er`”。
\B	匹配非单词边界。“`er\B`”能匹配“`verb`”中的“`er`”，但不能匹配“`never`”中的“`er`”。
\cx	匹配由x指明的控制字符。例如，\cM匹配一个Control-M或回车符。x的值必须为A-Z或a-z之一。否则，将c视为一个原义的“`c`”字符。
\d	匹配一个数字字符。等价于[0-9]。
\D	匹配一个非数字字符。等价于[^0-9]。
\f	匹配一个换页符。等价于\x0c和\cL。
\n	匹配一个换行符。等价于\x0a和\cJ。
\r	匹配一个回车符。等价于\x0d和\cM。
\s	匹配任何空白字符，包括空格、制表符、换页符等等。等价于[ \f\n\r\t\v]。
\S	匹配任何非空白字符。等价于[^ \f\n\r\t\v]。
\t	匹配一个制表符。等价于\x09和\cI。
\v	匹配一个垂直制表符。等价于\x0b和\cK。
\w	匹配包括下划线的任何单词字符。等价于“`[A-Za-z0-9_]`”。
\W	匹配任何非单词字符。等价于“`[^A-Za-z0-9_]`”。
\xn	匹配n，其中n为十六进制转义值。十六进制转义值必须为确定的两个数字长。例如，“`\x41`”匹配“`A`”。“`\x041`”则等价于“`\x04&1`”。正则表达式中可以使用ASCII编码。.
\num	匹配num，其中num是一个正整数。对所获取的匹配的引用。例如，“`(.)\1`”匹配两个连续的相同字符。
\n	标识一个八进制转义值或一个向后引用。如果n之前至少n个获取的子表达式，则n为向后引用。否则，如果n为八进制数字（0-7），则n为一个八进制转义值。
\nm	标识一个八进制转义值或一个向后引用。如果nm之前至少有nm个获得子表达式，则nm为向后引用。如果nm之前至少有n个获取，则n为一个后跟文字m的向后引用。如果前面的条件都不满足，若n和m均为八进制数字（0-7），则nm将匹配八进制转义值nm。
\nml	如果n为八进制数字（0-3），且m和l均为八进制数字（0-7），则匹配八进制转义值nml。
\un	匹配n，其中n是一个用四个十六进制数字表示的Unicode字符。例如，\u00A9匹配版权符号（©）。

常用正则表达式

用户名	/²{3,16}$/
密码	/³{6,18}$/
十六进制值	/^#?([a-f0-9]{6}\|[a-f0-9]{3})$/
电子邮箱	/^([a-z0-9_.-]+)@([\da-z.-]+).([a-z.]{2,6}) $KaTeX parse error: Undefined control sequence: \d at position 9: / /^[a-z\̲d̲]+(\.[a-z\d]+)*…$ /
URL	/^(https?😕/)?([\da-z.-]+).([a-z.]{2,6})([/\w .-])/?$/
IP 地址	/((2[0-4]\d\|25[0-5]\|[01]?\d\d?).){3}(2[0-4]\d\|25[0-5]\|[01]?\d\d?)/ /^(?😦?:25[0-5]\|2[0-4][0-9]\|[01]?[0-9][0-9]?).){3}(?:25[0-5]\|2[0-4][0-9]\|[01]?[0-9][0-9]?)$/
HTML 标签	/^<([a-z]+)([<]+)(?:>(.)</\1>\|\s+/>)$/
删除代码\注释	(?<!http:\|\S)//.*$
Unicode编码中的汉字范围	/⁴+$/