java正则表达式学习_Java正则表达式学习教程

本教程旨在帮助你驾驭Java正则表达式,同时也帮助我复习正则表达式。

什么是正则表达式?

正则表达式定义了字符串的模式。正则表达式可以用来搜索、编辑或处理文本。正则表达式并不仅限于某一种语言,但是在每种语言中有细微的差别。Java正则表达式和Perl的是最为相似的。

Java正则表达式的类在 java.util.regex 包中,包括三个类:Pattern,Matcher和 PatternSyntaxException。

Pattern对象是正则表达式的已编译版本。他没有任何公共构造器,我们通过传递一个正则表达式参数给公共静态方法 compile 来创建一个pattern对象。

Matcher是用来匹配输入字符串和创建的 pattern 对象的正则引擎对象。这个类没有任何公共构造器,我们用patten对象的matcher方法,使用输入字符串作为参数来获得一个Matcher对象。然后使用matches方法,通过返回的布尔值判断输入字符串是否与正则匹配。

如果正则表达式语法不正确将抛出PatternSyntaxException异常。

让我们在一个简单的例子里看看这些类是怎么用的吧

package com.journaldev.util;

import java.util.regex.Matcher;

import java.util.regex.Pattern;

public class RegexExamples {

public static void main(String[] args) {

// using pattern with flags

Pattern pattern = Pattern.compile("ab", Pattern.CASE_INSENSITIVE);

Matcher matcher = pattern.matcher("ABcabdAb");

// using Matcher find(), group(), start() and end() methods

while (matcher.find()) {

System.out.println("Found the text \"" + matcher.group()

+ "\" starting at " + matcher.start()

+ " index and ending at index " + matcher.end());

}

// using Pattern split() method

pattern = Pattern.compile("\\W");

String[] words = pattern.split("[email protected]#three:four$five");

for (String s : words) {

System.out.println("Split using Pattern.split(): " + s);

}

// using Matcher.replaceFirst() and replaceAll() methods

pattern = Pattern.compile("1*2");

matcher = pattern.matcher("11234512678");

System.out.println("Using replaceAll: " + matcher.replaceAll("_"));

System.out.println("Using replaceFirst: " + matcher.replaceFirst("_"));

}

}

既然正则表达式总是和字符串有关, Java 1.4对String类进行了扩展,提供了一个matches方法来匹配pattern。在方法内部使用Pattern和Matcher类来处理这些东西,但显然这样减少了代码的行数。

Pattern类同样有matches方法,可以让正则和作为参数输入的字符串匹配,输出布尔值结果。

下述的代码可以将输入字符串和正则表达式进行匹配。

String str = "bbb";

System.out.println("Using String matches method: "+str.matches(".bb"));

System.out.println("Using Pattern matches method: "+Pattern.matches(".bb", str));

所以如果你的需要仅仅是检查输入字符串是否和pattern匹配,你可以通过调用String的matches方法省下时间。只有当你需要操作输入字符串或者重用pattern的时候,你才需要使用Pattern和Matches类。

注意由正则定义的pattern是从左至右应用的,一旦一个原字符在一次匹配中使用过了,将不会再次使用。

例如,正则“121”只会匹配两次字符串“31212142121″,就像这样“_121____121″。

正则表达式通用匹配符号

1a549cedd8a01e2e56a136a768cfa83f.png

3a3736fa4f213eb6d228fff6b1641dfa.png

Java正则表达式元字符

37539bc4396dd4c897c91a6d97b19b19.png

有两种方法可以在正则表达式中像一般字符一样使用元字符。

在元字符前添加反斜杠(\)

将元字符置于\Q(开始引用)和\E(结束引用)间

正则表达式量词

量词指定了字符匹配的发生次数。

f05f2fce9ff1f3da0a626ed9062f83a6.png

量词可以和character classes和capturing group一起使用。

例如,[abc]+表示a,b或c出现一次或者多次。

(abc)+表示capturing group “abc”出现一次或多次。我们即将讨论capturing group。

正则表达式capturing group

Capturing group是用来对付作为一个整体出现的多个字符。你可以通过使用()来建立一个group。输入字符串中和capturing group相匹配的部分将保存在内存里,并且可以通过使用Backreference调用。

你可以使用matcher.groupCount方法来获得一个正则pattern中capturing groups的数目。例如((a)(bc))包含3个capturing groups; ((a)(bc)), (a) 和 (bc)。

你可以使用在正则表达式中使用Backreference,一个反斜杠(\)接要调用的group号码。

Capturing groups和Backreferences可能很令人困惑,所以我们通过一个例子来理解。

System.out.println(Pattern.matches("(\\w\\d)\\1", "a2a2")); //true

System.out.println(Pattern.matches("(\\w\\d)\\1", "a2b2")); //false

System.out.println(Pattern.matches("(AB)(B\\d)\\2\\1", "ABB2B2AB")); //true

System.out.println(Pattern.matches("(AB)(B\\d)\\2\\1", "ABB2B3AB")); //false

在第一个例子里,运行的时候第一个capturing group是(\w\d),在和输入字符串“a2a2″匹配的时候获取“a2″并保存到内存里。因此\1是”a2”的引用,并且返回true。基于相同的原因,第二行代码打印false。

试着自己理解第三行和第四行代码。:)

现在我们来看看Pattern和Matcher类中一些重要的方法。

我们可以创建一个带有标志的Pattern对象。例如Pattern.CASE_INSENSITIVE可以进行大小写不敏感的匹配。Pattern类同样提供了和String类相似的split(String) 方法

Pattern类toString()方法返回被编译成这个pattern的正则表达式字符串。

Matcher类有start()和end()索引方法,他们可以显示从输入字符串中匹配到的准确位置。

Matcher类同样提供了字符串操作方法replaceAll(String replacement)和replaceFirst(String replacement)。

现在我们在一个简单的java类中看看这些函数是怎么用的。

package com.journaldev.util;

import java.util.regex.Matcher;

import java.util.regex.Pattern;

public class RegexExamples {

public static void main(String[] args) {

// using pattern with flags

Pattern pattern = Pattern.compile("ab", Pattern.CASE_INSENSITIVE);

Matcher matcher = pattern.matcher("ABcabdAb");

// using Matcher find(), group(), start() and end() methods

while (matcher.find()) {

System.out.println("Found the text \"" + matcher.group()

+ "\" starting at " + matcher.start()

+ " index and ending at index " + matcher.end());

}

// using Pattern split() method

pattern = Pattern.compile("\\W");

String[] words = pattern.split("[email protected]#three:four$five");

for (String s : words) {

System.out.println("Split using Pattern.split(): " + s);

}

// using Matcher.replaceFirst() and replaceAll() methods

pattern = Pattern.compile("1*2");

matcher = pattern.matcher("11234512678");

System.out.println("Using replaceAll: " + matcher.replaceAll("_"));

System.out.println("Using replaceFirst: " + matcher.replaceFirst("_"));

}

}

上述程序的输出:

Found the text "AB" starting at 0 index and ending at index 2

Found the text "ab" starting at 3 index and ending at index 5

Found the text "Ab" starting at 6 index and ending at index 8

Split using Pattern.split(): one

Split using Pattern.split(): two

Split using Pattern.split(): three

Split using Pattern.split(): four

Split using Pattern.split(): five

Using replaceAll: _345_678

Using replaceFirst: _34512678

这是不是一个很全面的Java正则表达式学习教程,希望对大家的学习有所帮助。

这就是微学网-程序员之家为你提供的"Java正则表达式学习教程"希望对你有所帮助.本文来自网络,转载请注明出处:http://www.weixuecn.cn/article/12544.html

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
【优质项目推荐】 1、项目代码均经过严格本地测试,运行OK,确保功能稳定后才上传平台。可放心下载并立即投入使用,若遇到任何使用问题,随时欢迎私信反馈与沟通,博主会第一时间回复。 2、项目适用于计算机相关专业(如计科、信息安全、数据科学、人工智能、通信、物联网、自动化、电子信息等)的在校学生、专业教师,或企业员工,小白入门等都适用。 3、该项目不仅具有很高的学习借鉴价值,对于初学者来说,也是入门进阶的绝佳选择;当然也可以直接用于 毕设、课设、期末大作业或项目初期立项演示等。 3、开放创新:如果您有一定基础,且热爱探索钻研,可以在此代码基础上二次开发,进行修改、扩展,创造出属于自己的独特应用。 欢迎下载使用优质资源!欢迎借鉴使用,并欢迎学习交流,共同探索编程的无穷魅力! 基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip 基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip 基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值