正则表达式续上文

首先先来看看几个常用的组成表达式的字符的意思:

^           匹配输入字符串的开始位置。

$          匹配输入字符串的结束位置。

*           匹配前面的子表达式零次或多次。

+          匹配前面的子表达式一次或多次。

?         匹配前面的子表达式零次或一次,或指明一个非贪婪限定符。

[           标记一个中括号表达式的开始。

\           将下一个字符标记为或特殊字符、或原义字符、或向后引用、或八进制转义符。例如, 'n' 匹配字符 'n'。'\n' 匹配换行符。序列 '\\' 匹配 "\",而 '\(' 则匹配 "("。

现在看几个列子:

表示一个两位数: /[0-9][0-9]/

表示一个开头不为一的两位数:/[0,2-9][0-9]/

匹配一堆字符中的所有?:/[\?]*/

正则表达式就是通过最上面的一堆队友(字符),让他们互相组队,然后就可以指定规则,下面是组队所需要的队友:

普通字符

[ABC]:        匹配 [...] 中的所有字符,例如 [aeiou] 匹配字符串 "google runoob taobao" 中所有的 e o u a 字母。

[^ABC]:       匹配除了 [...] 中字符的所有字符,例如 [^aeiou] 匹配字符串 "google runoob taobao" 中除了 e o u a 字母的所有字母。

[A-Z]:           [A-Z] 表示一个区间,匹配所有大写字母,[a-z] 表示所有小写字母。

.    :              匹配除换行符(\n、\r)之外的任何单个字符,相等于 [^\n\r]。

[\s\S] :          匹配所有。\s 是匹配所有空白符,包括换行,\S 非空白符,不包括换行。

\w  :匹配字母、数字、下划线。等价于 [A-Za-z0-9_]

非打印字符

\cx :                匹配由x指明的控制字符。例如, \cM 匹配一个 Control-M 或回车符。x 的值必须为 A-Z 或 a-z 之一。否则,将 c 视为一个原义的 'c' 字符。

\f:             匹配一个换页符。等价于 \x0c 和 \cL。

\n:             匹配一个换行符。等价于 \x0a 和 \cJ。

\r:              匹配一个回车符。等价于 \x0d 和 \cM。

\s:             匹配任何空白字符,包括空格、制表符、换页符等等。等价于 [ \f\n\r\t\v]。注意 Unicode 正则表达式会匹配全角空格符。

\S:             匹配任何非空白字符。等价于 [^ \f\n\r\t\v]。

\t:              匹配一个制表符。等价于 \x09 和 \cI。

\v:             匹配一个垂直制表符。等价于 \x0b 和 \cK。

特殊字符

所谓特殊字符,就是一些有特殊含义的字符,如上面说的 runoo*b 中的 *,简单的说就是表示任何字符串的意思。如果要查找字符串中的 * 符号,则需要对 * 进行转义,即在其前加一个 \,runo\*ob 匹配字符串 runo*ob

许多元字符要求在试图匹配它们时特别对待。若要匹配这些特殊字符,必须首先使字符"转义",即,将反斜杠字符\ 放在它们前面。下表列出了正则表达式中的特殊字符:

$:                匹配输入字符串的结尾。

^:                匹配输入字符串的开始位置,除非在方括号表达式中使用,当该符号在方括号表达式中使用时,表示不接受该方括号表达式中的字符集合。

():              标记一个子表达式的开始和结束位置。子表达式可以获取供以后使用。要匹配这些字符,请使用 \( 和 \)。

*:                匹配前面的子表达式零次或多次。

+:                匹配前面的子表达式一次或多次。

?:                  匹配前面的子表达式零次或一次,或指明一个非贪婪限定符。

.:                匹配除换行符 \n 之外的任何单字符。

【:              标记一个中括号表达式的开始。

\:                  将下一个字符标记为或特殊字符、或原义字符、或向后引用、或八进制转义符。比如要匹配上面的字符,可以在要匹配的字符前加上“\”,        匹配“?”,便输入“\?”

{:                标记限定符表达式的开始。

|:                指明两项之间的一个选择。

限定符

*:                匹配前面的子表达式零次或多次。

+:                匹配前面的子表达式一次或多次。

?:                  匹配前面的子表达式零次或一次,或指明一个非贪婪限定符。

注意

* 和 + 限定符都是贪婪的,因为它们会尽可能多的匹配文字,只有在它们的后面加上一个 ? 就可以实现非贪婪或最小匹配。

{n}                n 是一个非负整数。匹配确定的 n 次。例如,'o{2}' 不能匹配 "Bob" 中的 'o',但是能匹配 "food" 中的两个 o。

{n,}             n 是一个非负整数。至少匹配n 次。例如,'o{2,}' 不能匹配 "Bob" 中的 'o',但能匹配 "foooood" 中的所有 o。'o{1,}' 等价于 'o+'。'o{0,}' 则等价于 'o*'。

{n,m}          n 和 m 均为非负整数,其中n <= m。最少匹配 n 次且最多匹配 m 次。例如,"o{1,3}" 将匹配 "fooooood" 中的前三个 o。'o{0,1}' 等价于 'o?'。请注意在逗号和两个数之间不能有空格。

定位符

$:                匹配输入字符串的结尾。

^:              匹配输入字符串的开始位置。

\b:               匹配一个单词边界,即字与空格间的位置。

\B:               匹配一个单词边界,即字与空格间的位置。

?=、?<=、?!、?<! 的使用区别

exp1(?=exp2):查找 exp2 前面的 exp1。

(?<=exp2)exp1:查找 exp2 后面的 exp1。

exp1(?!exp2):查找后面不是 exp2 的 exp1。

(?<!exp2)exp1:查找前面不是 exp2 的 exp1。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值