Java字符串分隔方法split实践

末蓝、 2022-04-11 08:43 899阅读 0赞
  1. 在工作中,有字符串分隔很自然也一直用Stringsplit方法,但直到今天,我竟然踩到了一个坑。

一.正常的分隔,分隔符是“:”

  1. package com.bijian.test;
  2. import java.util.List;
  3. import com.google.common.base.Splitter;
  4. public class SplitTest {
  5. private static final String SPLIT_CHAR = ":";
  6. public static void main(String[] args) {
  7. String str = "21001:03";
  8. splitMethod1(str);
  9. splitMethod2(str);
  10. }
  11. private static void splitMethod1(String str) {
  12. String[] strList = str.split(SPLIT_CHAR);
  13. String firstStr = strList[0];
  14. String secondStr = strList[1];
  15. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  16. }
  17. private static void splitMethod2(String str) {
  18. List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
  19. String firstStr = strList.get(0);
  20. String secondStr = strList.get(1);
  21. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  22. }
  23. }

运行结果:

  1. firstStr:21001,secondStr:03
  2. firstStr:21001,secondStr:03

二.复杂的分隔,分隔符是“:@:”

  1. package com.bijian.test;
  2. import java.util.List;
  3. import com.google.common.base.Splitter;
  4. public class SplitTest {
  5. private static final String SPLIT_CHAR = ":@:";
  6. public static void main(String[] args) {
  7. String str = "21001:@:03";
  8. splitMethod1(str);
  9. splitMethod2(str);
  10. }
  11. private static void splitMethod1(String str) {
  12. String[] strList = str.split(SPLIT_CHAR);
  13. String firstStr = strList[0];
  14. String secondStr = strList[1];
  15. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  16. }
  17. private static void splitMethod2(String str) {
  18. List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
  19. String firstStr = strList.get(0);
  20. String secondStr = strList.get(1);
  21. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  22. }
  23. }

运行结果:

  1. firstStr:21001,secondStr:03
  2. firstStr:21001,secondStr:03

三.将实例二中的@换成|,即分隔符为“:|:”

  1. package com.bijian.test;
  2. import java.util.List;
  3. import com.google.common.base.Splitter;
  4. public class SplitTest {
  5. private static final String SPLIT_CHAR = ":|:";
  6. public static void main(String[] args) {
  7. String str = "21001:|:03";
  8. splitMethod1(str);
  9. splitMethod2(str);
  10. }
  11. private static void splitMethod1(String str) {
  12. String[] strList = str.split(SPLIT_CHAR);
  13. String firstStr = strList[0];
  14. String secondStr = strList[1];
  15. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  16. }
  17. private static void splitMethod2(String str) {
  18. List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
  19. String firstStr = strList.get(0);
  20. String secondStr = strList.get(1);
  21. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  22. }
  23. }

运行结果:

  1. firstStr:21001,secondStr:|
  2. firstStr:21001,secondStr:03

四.原来是“|”的问题,分隔符仅为“|”测试运行如下

  1. package com.bijian.test;
  2. import java.util.List;
  3. import com.google.common.base.Splitter;
  4. public class SplitTest {
  5. private static final String SPLIT_CHAR = "|";
  6. public static void main(String[] args) {
  7. String str = "21001|03";
  8. splitMethod1(str);
  9. splitMethod2(str);
  10. }
  11. private static void splitMethod1(String str) {
  12. String[] strList = str.split(SPLIT_CHAR);
  13. String firstStr = strList[0];
  14. String secondStr = strList[1];
  15. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  16. }
  17. private static void splitMethod2(String str) {
  18. List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
  19. String firstStr = strList.get(0);
  20. String secondStr = strList.get(1);
  21. System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
  22. }
  23. }

运行结果:

  1. firstStr:,secondStr:2
  2. firstStr:21001,secondStr:03

五.案例分析

  1. 使用String.split方法分隔字符串时,分隔符如果用到一些特殊字符,可能会得不到我们预期的结果。
  2. 我们看jdk doc中说明
  3. public String[] split(String regex)
  4. Splits this string around matches of the given regular expression.
  5. 参数regex是一个 regular-expression的匹配模式而不是一个简单的String,他对一些特殊的字符可能会出现你预想不到的结果,比如测试下面的代码:
  6. 1.用竖线 | 分隔字符串,你将得不到预期的结果
  7. public static void splitTest02() {
  8. String splitChar = "|"; //结果不正确
  9. //String splitChar = "\\|";
  10. String str = "bijian|bi|jian";
  11. String[] strs = str.split(splitChar);
  12. System.out.println(strs[0]);
  13. System.out.println(strs[1]);
  14. System.out.println(strs[2]);
  15. }
  16. 2.用竖 \* 分隔字符串运行将抛出java.util.regex.PatternSyntaxException异常,用加号 + 也是如此。
  17. public static void splitTest04() {
  18. String[] aa = "aaa*bbb*ccc".split("*"); //Exception in thread "main" java.util.regex.PatternSyntaxException: Dangling meta character '*' near index 0
  19. //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果
  20. for (int i = 0 ; i <aa.length ; i++ ) {
  21. System.out.println("--"+aa[i]);
  22. }
  23. }
  24. 显然,+ \* 不是有效的模式匹配规则表达式,用"\\\\\*" "\\\\+"转义后即可得到正确的结果。"|" 分隔串时虽然能够执行,但是却不是预期的目的,"\\\\|"转义后即可得到正确的结果。
  25. 如果想在串中使用""字符,则也需要转义。首先要表达"aaaa\\bbbb"这个串就应该用"aaaa\\\\bbbb",如果要分隔就应该这样才能得到正确结果:
  26. String[] aa = "aaa\\bbb\\bccc".split("\\\\");

六.小结

  1. 1.如果用"."作为分隔的话,必须是如下写法:String.split("\\\\."),这样才能正确的分隔开,不能用String.split(".");
  2. 2.如果用"|"作为分隔的话,必须是如下写法:String.split("\\\\|"),这样才能正确的分隔开,不能用String.split("|");
  3. ".""|"都是转义字符,必须得加"\\";
  4. 但实际上这样还是有坑,String 自带的Split 分割字符串类中不会把分割字符串后的空字符串添加到数组当中,String\[\] str = "000|111|222||".split("\\\\|");进行分割后字符串的长度为3,只能得到str\[0\],str\[1\],str\[2\],后面的str\[3\],str\[4\]是不存在的,如果直接访问str\[3\],str\[4\]会发生以下错误:java.lang.ArrayIndexOutOfBoundsException
  5. 3.如果在一个字符串中有多个分隔符,可以用"|"作为连字符,比如:"acount=? and uu =? or n=?",把三个都分隔出来,可以用String.split("and|or");
  6. 4.采用com.google.common.base.Splitteron方法,如上实例所示。【综合考虑,这种方法很OK
  7. 5.使用org.apache.commons.lang.StringUtils.splitPreserveAllTokens 方法。【综合考虑,这种方法很OK
  8. 6.使用String.split(str, n);指定分隔的次数。【这个测试是OK的,但在具体使用中,很难知道我要分隔的次数】

9629552a-0dad-3d00-a2da-896ca0c27251.png

附:测试实例

  1. package com.bijian.test;
  2. public class SplitTest {
  3. public static void main(String[] args) {
  4. splitTest05();
  5. }
  6. public static void splitTest01() {
  7. //String splitChar = "."; //结果不正确
  8. String splitChar = "\\.";
  9. String str = "bijian.bi.jian";
  10. String[] strs = str.split(splitChar);
  11. System.out.println(strs[0]);
  12. System.out.println(strs[1]);
  13. System.out.println(strs[2]);
  14. }
  15. public static void splitTest02() {
  16. String splitChar = "|"; //结果不正确
  17. //String splitChar = "\\|";
  18. String str = "bijian|bi|jian";
  19. String[] strs = str.split(splitChar);
  20. System.out.println(strs[0]);
  21. System.out.println(strs[1]);
  22. System.out.println(strs[2]);
  23. }
  24. public static void splitTest03() {
  25. String splitChar = "and|or";
  26. String str = "acount=? and uu =? or n=?";
  27. String[] strs = str.split(splitChar);
  28. System.out.println(strs[0]);
  29. System.out.println(strs[1]);
  30. System.out.println(strs[2]);
  31. }
  32. public static void splitTest04() {
  33. String[] aa = "aaa*bbb*ccc".split("*"); //Exception in thread "main" java.util.regex.PatternSyntaxException: Dangling meta character '*' near index 0
  34. //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果
  35. for (int i = 0 ; i <aa.length ; i++ ) {
  36. System.out.println("--"+aa[i]);
  37. }
  38. }
  39. public static void splitTest05() {
  40. String[] aa = "aaa\\bbb\\bccc".split("\\\\");
  41. for (int i = 0 ; i <aa.length ; i++ ) {
  42. System.out.println(aa[i]);
  43. }
  44. }
  45. }

发表评论

表情:
评论列表 (有 0 条评论,899人围观)

还没有评论,来说两句吧...

相关阅读

    相关 字符串分隔 java

    字符串分隔 题目描述 •连续输入字符串,请按长度为8拆分每个字符串后输出到新的字符串数组; •长度不是8整数倍的字符串请在后面补数字0,空字符串不处理。 输入描

    相关 Java字符串分隔

    题目描述 •连续输入字符串,请按长度为8拆分每个字符串后输出到新的字符串数组; •长度不是8整数倍的字符串请在后面补数字0,空字符串不处理。 输入描述: 连续输