`

Java字符串分隔方法split实践

阅读更多

        在工作中,有字符串分隔很自然也一直用String的split方法,但直到今天,我竟然踩到了一个坑。

一.正常的分隔,分隔符是“:”

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = ":";
    
    public static void main(String[] args) {
        String str = "21001:03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:21001,secondStr:03
firstStr:21001,secondStr:03

 

二.复杂的分隔,分隔符是“:@:”

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = ":@:";
    
    public static void main(String[] args) {
        String str = "21001:@:03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:21001,secondStr:03
firstStr:21001,secondStr:03

 

三.将实例二中的@换成|,即分隔符为“:|:”

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = ":|:";
    
    public static void main(String[] args) {
        String str = "21001:|:03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:21001,secondStr:|
firstStr:21001,secondStr:03

 

四.原来是“|”的问题,分隔符仅为“|”测试运行如下

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = "|";
    
    public static void main(String[] args) {
        String str = "21001|03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:,secondStr:2
firstStr:21001,secondStr:03

 

五.案例分析

        使用String.split方法分隔字符串时,分隔符如果用到一些特殊字符,可能会得不到我们预期的结果。

        我们看jdk doc中说明

public String[] split(String regex)
 Splits this string around matches of the given regular expression.

        参数regex是一个 regular-expression的匹配模式而不是一个简单的String,他对一些特殊的字符可能会出现你预想不到的结果,比如测试下面的代码:

        1.用竖线 | 分隔字符串,你将得不到预期的结果

public static void splitTest02() {
        
        String splitChar = "|";  //结果不正确
        //String splitChar = "\\|";
        
        String str = "bijian|bi|jian";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
}

        2.用竖 * 分隔字符串运行将抛出java.util.regex.PatternSyntaxException异常,用加号 + 也是如此。

public static void splitTest04() {
        
        String[] aa = "aaa*bbb*ccc".split("*"); //Exception in thread "main" java.util.regex.PatternSyntaxException: Dangling meta character '*' near index 0
        //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果   
        for (int i = 0 ; i <aa.length ; i++ ) {
          System.out.println("--"+aa[i]);
        }
}

        显然,+ * 不是有效的模式匹配规则表达式,用"\\*" "\\+"转义后即可得到正确的结果。"|" 分隔串时虽然能够执行,但是却不是预期的目的,"\\|"转义后即可得到正确的结果。

        如果想在串中使用""字符,则也需要转义。首先要表达"aaaa\bbbb"这个串就应该用"aaaa\\bbbb",如果要分隔就应该这样才能得到正确结果:

String[] aa = "aaa\\bbb\\bccc".split("\\\\");

 

六.小结

        1.如果用"."作为分隔的话,必须是如下写法:String.split("\\."),这样才能正确的分隔开,不能用String.split(".");

        2.如果用"|"作为分隔的话,必须是如下写法:String.split("\\|"),这样才能正确的分隔开,不能用String.split("|");

        "."和"|"都是转义字符,必须得加"\";

        但实际上这样还是有坑,String 自带的Split 分割字符串类中不会把分割字符串后的空字符串添加到数组当中,String[] str = "000|111|222||".split("\\|");进行分割后字符串的长度为3,只能得到str[0],str[1],str[2],后面的str[3],str[4]是不存在的,如果直接访问str[3],str[4]会发生以下错误:java.lang.ArrayIndexOutOfBoundsException。

        3.如果在一个字符串中有多个分隔符,可以用"|"作为连字符,比如:"acount=? and uu =? or n=?",把三个都分隔出来,可以用String.split("and|or");

        4.采用com.google.common.base.Splitter的on方法,如上实例所示。【综合考虑,这种方法很OK】

        5.使用org.apache.commons.lang.StringUtils.splitPreserveAllTokens 方法。【综合考虑,这种方法很OK】

        6.使用String.split(str, n);指定分隔的次数。【这个测试是OK的,但在具体使用中,很难知道我要分隔的次数】


 

附:测试实例

package com.bijian.test;

public class SplitTest {

    public static void main(String[] args) {
        splitTest05();
    }
    
    public static void splitTest01() {
        
        //String splitChar = ".";  //结果不正确
        String splitChar = "\\.";
        
        String str = "bijian.bi.jian";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
    }
    
    public static void splitTest02() {
        
        String splitChar = "|";  //结果不正确
        //String splitChar = "\\|";
        
        String str = "bijian|bi|jian";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
    }
    
    public static void splitTest03() {
        
        String splitChar = "and|or";
        String str = "acount=? and uu =? or n=?";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
    }
    
    public static void splitTest04() {
        
        String[] aa = "aaa*bbb*ccc".split("*"); //Exception in thread "main" java.util.regex.PatternSyntaxException: Dangling meta character '*' near index 0
        //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果   
        for (int i = 0 ; i <aa.length ; i++ ) {
          System.out.println("--"+aa[i]);
        }
    }
    
    public static void splitTest05() {
        
        String[] aa = "aaa\\bbb\\bccc".split("\\\\");
        for (int i = 0 ; i <aa.length ; i++ ) {
            System.out.println(aa[i]);
        }
    }
}

 

  • 大小: 45.8 KB
分享到:
评论

相关推荐

    java 中字符串只中英数字混合需要分割的解决办法

    这个方法用来处理java中可能有一些特别的需要,一大串中英文混合,需要中间截断或是中英中间添加一些特别的标识,调用这个方法 第一个参数是要处理的字符串,第二个是要在中英字符中间插入的字符。调用就可以得到想...

    Java字符串逗号分割实现.pptx.pptx

    split()函数可以将字符串按照指定的分隔符进行分割,返回一个字符串数组,我们可以通过Arrays.asList()方法将其转换为列表。 Stream API的应用 Java8引入了Stream API,其中的of()方法和map()方法可以方便地将字符串...

    java字符串转数组.docx

    在Java中,将字符串转换为数组可以通过以下几种方式实现: ...这个方法将字符串根据指定的分隔符分割成字符串数组。 示例:String[] stringArray = str.split(","); 使用java.util.Arrays类的copyOfRange()方法:

    java用split分割字符串的一个有趣现象

    最近在项目中使用了java中的split分割字符串,发现了一个bug,充分了展示了自己对java底层的认知有很多的不足和欠缺。下面将这次的经过总结出来分享给大家,有需要的朋友们可以参考借鉴,下面来一起看看吧。

    java 中用split分割字符串,最后的空格等不被拆分的方法

    下面小编就为大家带来一篇java 中用split分割字符串,最后的空格等不被拆分的方法。小编觉得挺不错的,现在就分享给大家,也给大家做个参考。一起跟随小编过来看看吧

    详解C++的String类的字符串分割实现

    在Java下直接用String的split函数就可以了。c++下String没有直接提供这个函数,需要自己写。 网上给出的解决方案是这里的三种方法。但我是通过JNI访问的,在里面用这些vector可能不中,自己封装了个,仅供参考: ...

    string类的常用方法.zip

    但是,你可以使用 str 类的方法来创建新的字符串或对字符串进行操作。 1. capitalize() 将字符串的首字母大写,其余字母小写。 2. lower() 和 upper() 将字符串转换为小写或大写。 3. strip(), lstrip(), ...

    leetcode添加元素使和等于-LeetCode:LeetCode解决方案和技巧

    除撇号外,所有非字母数字的Java字符串拆分 // 用除英文字符以外的所有符号 分割 words= Str.split("\\W+"); words = Str.split("[^\\w']+"); // 非特殊英文字符 words = Str.split("[^a-zA-Z0-9']+"); // 特殊英文...

    java五子棋

    // 将用户输入的字符串以逗号(,)作为分隔,分隔成两个字符串 String[] posStrArr = inputStr.split(","); try { posX = Integer.parseInt(posStrArr[0]) - 1; posY = Integer.parseInt(posStrArr[1]) - ...

    java实现的文件复制

    //split()方法按照指定的分隔符拆分字符串为字符数组 String[] c = command.split(" "); String pathName = c[1]; String target_path = c[2]; FileUtil fileUtil = new FileUtil(); //读取文件 ...

    Java-PHP-C#

    上面的正则表达式"/"就是分隔符,两个"/"之间的就是表达式,第二个"/"后面的字符串"is"就是修饰符。 在表达式中如果含有分隔符,那么就需要使用转义符号"\",比如"/hello.+?\/hello/is"。转义符号除了用于分隔符...

    BJ IT公司面试题集

    3.写一个函数要求输入一个字符串和一个字符长度,对该字符串进行分隔;(Core Java) 答:函数代码如下: public String[] split(String str, int chars){ int n = (str.length()+ chars - 1)/chars; String ret[]...

    一个java正则表达式工具类源代码.zip(内含Regexp.java文件)

    22. 匹配由26个英文字母的大写组成的字符串 23 匹配由26个英文字母的小写组成的字符串 24 匹配由数字和26个英文字母组成的字符串; 25 匹配由数字、26个英文字母或者下划线组成的字符串; java源码: /* * Created ...

    hive函数大全(中文版)

    4. 带分隔符字符串连接函数:concat_ws 23 5. 字符串截取函数:substr,substring 24 6. 字符串截取函数:substr,substring 24 7. 字符串转大写函数:upper,ucase 24 8. 字符串转小写函数:lower,lcase 25 9. 去空格...

    ORACLE,mysql,sqlserver,sybase数据库装文本软件

    3.支持任意字符串作为每行分隔符,例如\r,\r\n,或者十六进制字符或任意指定的字符串(例如可实现把整个日志文件装入数据库的单个clob字段). 4.支持任意大小的文本,装入几十GB都试过没问题。 5.明确到每一行的错误信息....

    JavaScript笔记

    |--x.split(bystr): 拆分子字符串。 |--String与正则表达式 |--str.match(regExp);--查找str中匹配正则表达式的关键字 | 返回:如果没找到,返回null。若找到,返回1个数组,数组的每个元素是每个找到的匹配...

    Python核心编程第二版(ok)

     6.4.2 字符串模板c更简单的替代品   6.4.3 原始字符串操作符(rR)   6.4.4 Unicode字符串操作符(uU)   6.5 内建函数   6.5.1 标准类型函数   6.5.2 序列类型函数   6.5.3 字符串类型函数  ...

    Python核心编程第二版

     6.4.2 字符串模板: 更简单的替代品   6.4.3 原始字符串操作符(r/R)   6.4.4 Unicode字符串操作符(u/U)   6.5 内建函数   6.5.1 标准类型函数   6.5.2 序列类型函数   6.5.3 字符串类型函数...

    freemarker总结

    有一种特殊的字符串称为raw字符串,被认为是纯文本,其中的\和{等不具有特殊含义,该类字符串在引号前面加r,下面是一个例子: ${r"/${data}"year""}屏幕输出结果为:/${data}"year" 转义 含义 ...

Global site tag (gtag.js) - Google Analytics