oracle 正则表达式

最新推荐文章于 2023-05-22 09:34:00 发布

rgb_rgb

最新推荐文章于 2023-05-22 09:34:00 发布

阅读量295

点赞数

分类专栏： sql语句

sql语句专栏收录该内容

14 篇文章 0 订阅

订阅专栏

原文：http://www.jb51.net/article/31227.htm

Oracle正则表达式(regularexpression)

元字符	字符含义	举例说明
^	匹配字符串的开始位置(在[]中使用，此时它表示不接受该字符集合。	^a：匹配以a开始的字符串 [^a]：匹配不含a的字符串
-	当使用在a-m表示范围；当使用在第一个字符时表示连字符串，如[-abc]
$	匹配字符结束位置	‘a$'：匹配以a结束的字符串
.	匹配除换行符 n之外的任何单字符。
?	匹配前面的子表达式零次或一次	tr(y(ing)?)：可以表示try或者trying
*	匹配前面的子表达式零次或多次
+	匹配前面的子表达式一次或多次
()	标记一个子表达式的开始和结束位置	a(b)*可以匹配 ab,abb,abbb,youabb (c\|d)匹配c或d
[]	标记一个中括号表达式	[cd]匹配选择c或d等同于 (c\|d)。匹配的是单字符，[^cd]是匹配c,d之外的单字符。 [a-z]表示所有小写字母
{m,n}	m= <出现次数 <=n，'{m}'表示出现m次，'{m,}'表示至少出现m次。
\|	表示或者的关系。指明两项之间的一个选择
字符簇	字符含义
[[:alpha:]]	任何字母。
[[:digit:]]	[[:digit:]] 任何数字。
[[:alnum:]]	任何字母和数
[[:space:]]	任何白字符。
[[:upper:]]	任何大写字母。
[[:lower:]]	任何小写字母。
[[:punct:]]	任何标点符号。
[[:xdigit:]]	任何16进制的数字，相当于[0-9a-fA-F]。

Oracle支持正则表达式的内置函数

名称

语法

备注

REGEXP_LIKE

(source_string,

pattern

[, match_parameter]

)

source_string：

源字符串

Pattern：

正则表达式

match_parameter：

匹配模式(i:不区分大小写；c:区分大小写；n:允许使用可以匹配任意字符串的操作符；m:将x作为一个包含多行的字符串。

REGEXP_REPLACE

(source_string,

pattern

[,replace_string]

[,position]

[,occurtence]

[,match_parameter]

)

replace_string：

用于替换的字符串

Position：

开始搜索的起始位置

occurtence

指定替换第n次出现字符串

其他同上。

REGEXP_SUBSTR

(source_string, pattern

[,position

[,occurrence

[,match_parameter]]]

)

Position：

指定在字符串中准确位置，默认为1

Occurrence：

指定在源字符串匹配过程中相对其他字符串，哪个字符串应该匹配。例如

select regexp_substr('The zip code

80831 is for falcon, co',

'[[:alpha:]]{3,}', 1, 3)

from dual;

结果选择的是code而非The或zip。

REGEXP_INSTR

(source_string,

pattern

[,start_position

[,occurrence

[,return_option

[,match_parameter]]]]

)

start_position：

开始搜索位置

Occurrence：

第n次出现pattern，默认为1

return_option：

0：pattern的起始位置

1：pattern下一个字符起始位置

默认为0

REGEXP_COUNT

(source_string,

pattern

[[,start_position]

[,match_parameter]])

11g新增的函数，表示pattern在原字符串中出现的次数

start_position：

开始搜索的位置

SQL> select regexp_replace('XX路1001弄12幢102室', '\d+幢', '') from dual;

REGEXP_REPLACE(
---------------
XX路1001弄102室

select length(name),name,getCustText19(upper(name)),regexp_replace(upper(name),'[^[:alpha:]]','') from dual;

特殊字符：
'^' 匹配输入字符串的开始位置，在方括号表达式中使用，此时它表示不接受该字符集合。
'$' 匹配输入字符串的结尾位置。如果设置了 RegExp 对象的 Multiline 属性，则 $ 也匹配 'n' 或 'r'。
'.' 匹配除换行符 n之外的任何单字符。
'?' 匹配前面的子表达式零次或一次。
'*' 匹配前面的子表达式零次或多次。
'+' 匹配前面的子表达式一次或多次。
'( )' 标记一个子表达式的开始和结束位置。
'[]' 标记一个中括号表达式。
'{m,n}' 一个精确地出现次数范围，m=<出现次数<=n，'{m}'表示出现m次，'{m,}'表示至少出现m次。
'|' 指明两项之间的一个选择。例子'^([a-z]+|[0-9]+)$'表示所有小写字母或数字组合成的字符串。
num 匹配 num，其中 num 是一个正整数。对所获取的匹配的引用。
正则表达式的一个很有用的特点是可以保存子表达式以后使用，被称为Backreferencing. 允许复杂的替换能力
如调整一个模式到新的位置或者指示被代替的字符或者单词的位置. 被匹配的子表达式存储在临时缓冲区中，
缓冲区从左到右编号, 通过数字符号访问。下面的例子列出了把名字 aa bb cc 变成
cc, bb, aa.
Select REGEXP_REPLACE('aa bb cc','(.*) (.*) (.*)', '3, 2, 1') FROM dual；
REGEXP_REPLACE('ELLENHILDISMIT
cc, bb, aa
'' 转义符。

字符簇：
[[:alpha:]] 任何字母。
[[:digit:]] 任何数字。
[[:alnum:]] 任何字母和数字。
[[:space:]] 任何白字符。
[[:upper:]] 任何大写字母。
[[:lower:]] 任何小写字母。
[[:punct:]] 任何标点符号。
[[:xdigit:]] 任何16进制的数字，相当于[0-9a-fA-F]。

各种操作符的运算优先级
转义符
(), (?:), (?=), [] 圆括号和方括号
*, +, ?, {n}, {n,}, {n,m} 限定符
^, $, anymetacharacter 位置和顺序
| “或”操作