今天遇到的一个问题----java String.split( Regex )的误区

原创 2006年05月31日 23:37:00

今天用了 str.split("*"),遇到了错误,问题如下:


java 中split的用法 Text
在使用String.split方法分隔字符串时,分隔符如果用到一些特殊字符,可能会得不到我们预期的结果。

我们看jdk doc中说明

public String[] split(String regex)

 Splits this string around matches of the given regular expression. 

参数regex是一个 regular-expression的匹配模式而不是一个简单的String,他对一些特殊的字符可能会出现你预想不到的结果,比如测试下面的代码:

用竖线 | 分隔字符串,你将得不到预期的结果

    String[] aa = "aaa|bbb|ccc".split("|";
    //String[] aa = "aaa|bbb|ccc".split("//|"; 这样才能得到正确的结果

    for (int i = 0 ; i <aa.length ; i++  {
      System.out.println("--"+aa[i]);
    }

用竖 * 分隔字符串运行将抛出java.util.regex.PatternSyntaxException异常,用加号 + 也是如此。

    String[] aa = "aaa*bbb*ccc".split("*";
    //String[] aa = "aaa|bbb|ccc".split("//*"; 这样才能得到正确的结果   

    for (int i = 0 ; i <aa.length ; i++  {
      System.out.println("--"+aa[i]);
    }

显然,+ * 不是有效的模式匹配规则表达式,用"//*" "//+"转义后即可得到正确的结果。

"|" 分隔串时虽然能够执行,但是却不是预期的目的,"//|"转义后即可得到正确的结果。

还有如果想在串中使用"/"字符,则也需要转义.首先要表达"aaaa/bbbb"这个串就应该用"aaaa//bbbb",如果要分隔就应该这样才能得到正确结果:

String[] aa = "aaa//bbb//bccc".split("////";

版权声明:本文为博主原创文章,未经博主允许不得转载。

相关文章推荐

java中split(regex)使用中要注意的问题:正则表达式

比如我在项目中遇到的(,),.,|,*等等类的符号: String area="(30.13206313822174, 120.4156494140625)(29.87637380707133, 1...

[每天一个知识点]11-Java语言-String.split

今天继续讲String类,集中几天时间把String这个最常用的类型过一遍。 String的split方法有2个 String[] split(String regex) Splits this ...

小问题记录:JAVA String.split

引用其他博主的一片博文,学习一下split的用法:原文地址http://yangzb.iteye.com/blog/1824761 在java.lang包中有String.split()方法,返回是...

关于String.split(String regex, int limit)

转载地址:http://blog.sina.com.cn/s/blog_6a332a090100vrs6.html public String[] split(String regex, i...

java.lang.String的substring、split方法引起的内存问题

本文大部分内容,摘自下面两篇文章:            http://blog.xebia.com/2007/10/04/leaking-memory-in-java/、         ...

String contains 和 split 遇到的细节问题

今天在使用String时,遇到以后没有注意过的细节问题,记录一下。 String.contains(CharSequence s); String.split(String regex...

【Java】今天想到一个很傻的问题

1.问题:为什么有点调用(‘.’)方法和赋值号赋值方法(‘=’),为什么还有get和set方法?2.源代码:public class TestDemo5 { public static voi...

今天写python的一个定时关机小脚本遇到的问题

import wx import os import sys import time import threadingdef daojishi(ti): while ti>0: ...

初学shell,今天遇到由wget下载到本地的网页源代码的乱码问题,无聊的写了一个转码的脚本

今天用wget想下载文件,结果下载了一堆本地的index.html文件,一查看全是乱码,然后百度了一下,网页的编码格式大概有三种: 1、utf-8 2、gb2312 3、gbk 要在网页源码中...
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:深度学习:神经网络中的前向传播和反向传播算法推导
举报原因:
原因补充:

(最多只允许输入30个字)