Matcher
Matcher可以理解为“某次具体匹配的结果对象”
把编译好的Pattern对象“应用”到某个String对象上,就获得了作为“本次匹配结果”的Matcher对象。
之后,就可以通过它获得关于匹配的信息。
Pattern pattern = Pattern.compile("\\d{4}-\\d{2}-\\d{2}"); Matcher matcher = pattern.matcher("2010-12-20 2011-02-14"); while(matcher.find()){ System.out.println(matcher.group()); }
对编译好的Pattern对象调用matcher(String text)方法,传入要匹配的字符串text,就得到了Matcher对象,每次调用一次find()方法,如果返回true,就表示“找到一个匹配”,此时可以通过下面的若干方法获得关于本次匹配的信息。
String group(int n)
返回当前匹配中第n对捕获括号捕获的文本,如果n为0,则取匹配的全部内容;如果n小于0或者大于最大分组编号数,则报错。
String group()
返回当前匹配的全部文本,相当于group(0)。
int groupCount()
返回此Matcher对应Pattern对象中包含的捕获分组数目,编号为0的默认分组不计在内。
int start(n)
返回当前匹配中第n对捕获括号匹配的文本在原字符串中的起始位置。
int start()
返回当前匹配的文本在原字符串中的起始位置,相当于start(0)。
int end(n)
返回当前匹配中第n对捕获括号匹配的文本在原字符串中的结束位置。
int end()
返回当前匹配的文本在原字符串中的结果位置,相当于end(0)。
String replaceAll(String replacement)
如果进行正则表达式替换,一般用到的是Matcher的replaceAll()方法,它会将原有文本中正则表达式能匹配的所有文本替换为replaceement字符串。
String
许多时候只需要临时使用某个正则表达式,而不需要重复使用,这时候每次都生成Pattern对象和Matcher对象再操作显得很烦琐。所以,Java的String类提供了正则表达式操作的静态成员方法,只需要String对象就可以执行正则表达式操作。
这个方法判断当前的String对象能否由正则表达式regex
匹配。
请注意,这里的“匹配”指的并不是regex
能否在String
内找到匹配,而是指regex
匹配整个String
对象,因此非常适合用来做数据校验。
"123456".matches("\\d{6}"); //true "a123456".matches("\\d{6}"); //true 2. String replaceFirst(String regex,String replacement)
用来替换正则表达式regex在字符串中第一次能匹配的文本,可以在replacement字符串中用$num引用regex中对应捕获分组匹配的文本。
"2010-12-20 2011-02-14".replaceFirst("(\\d{4})-(\\d{2})-(\\d{2})","$2/$3/$1");
用来进行所有的替换,它的结果等同于Matcher类的replaceAll(),replacement字符串中也可以用$num的表示法引用regex中对应捕获分组匹配的文本。
"2010-12-20 2011-02-14".replaceAll("(\\d{4})-(\\d{2})-(\\d{2})","$2/$3/$1");
在java.lang包中有String.split()方法,返回是一个数组
我在应用中用到一些,给大家总结一下,仅供大家参考:
1、如果用“.”作为分隔的话,必须是如下写法,String.split("\."),这样才能正确的分隔开,不能用String.split(".");
2、如果用“|”作为分隔的话,必须是如下写法,String.split("\|"),这样才能正确的分隔开,不能用String.split("|");
“.”和“|”都是转义字符,必须得加"\";
3、如果在一个字符串中有多个分隔符,可以用“|”作为连字符,比如,“acount=? and uu =? or n=?”,把三个都分隔出来,可以用String.split(“and|or”);
使用String.split方法分隔字符串时,分隔符如果用到一些特殊字符,可能会得不到我们预期的结果。
我们看jdk doc中说明
public String[] split(String regex)
Splits this string around matches of the given regular expression.
参数regex是一个 regular-expression的匹配模式而不是一个简单的String,他对一些特殊的字符可能会出现你预想不到的结果,比如测试下面的代码用竖线 | 分隔字符串,你将得不到预期的结果
String[] aa = "aaa|bbb|ccc".split("|"); //String[] aa = "aaa|bbb|ccc".split("\\|"); 这样才能得到正确的结果 for (int i = 0 ; i <aa.length ; i++ ) { System.out.println("--"+aa[i]); }
用竖 * 分隔字符串运行将抛出java.util.regex.PatternSyntaxException异常,用加号 + 也是如此。
String[] aa = "aaa*bbb*ccc".split("*"); //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果 for (int i = 0 ; i <aa.length ; i++ ) { System.out.println("--"+aa[i]); }
显然, + * 不是有效的模式匹配规则表达式,用"\*" "\+"转义后即可得到正确的结果。
“|” 分隔串时虽然能够执行,但是却不是预期的目的,"\|"转义后即可得到正确的结果。
还有如果想在串中使用"“字符,则也需要转义.首先要表达"aaaa\bbbb"这个串就应该用"aaaa\bbbb”,如果要分隔就应该这样才能得到正确结果,
String[] aa = "aaa\\bbb\\bccc".split("\\\\");
使用场景
- 限制不同类型的文本所需的+字符类型