Java中正则表达式相关的类都在java.util.regex之内,一般来说,主要用到的是这两个类:java.util.regex.Pattern和java.util.regex.Matcher。Pattern对应正则表达式,一个Pattern与一个String对象关联,生成一个Matcher,它对应Pattern在String中的一次匹配; 调用Matcher对象的find()方法,Matcher对象就会更新为下一次匹配的匹配信息。示例:
Pattern pattern = Pattern.compile("\\d{4}-\\d{2}-]]d{2}"); String string = "2010-12-20 2011-02-14"; Matcher matcher = pattern.matcher(string); while(matcher.find()) { System.out.println(matcher.group(0)); }
Pattern
Pattern是Java语言中的正则表达式对象。要使用正则表达式,首先必须从字符串“编译”出Pattern对象,这需要用到Pattern.compile(String regex)方法。
Pattern pattern = Pattern.compile("a.b+");
如果要指定匹配模式,可以在表达式中使用(?modifier)修饰符指定,也可以使用预定义常量。下面的两个Pattern对象的生成方法不同,结果却是等价的。
Pattern pattern = Pattern.compile("(?i)a.b+"); Pattern pattern = Pattern.compile("a.b+",Pattern.CASE_INSENSITIVE);
如果要同时指定多种模式,可以连写模式修饰符,也可以直接用|运算符将预定义常量连接起来,以下两个Pattern对象也是等价的。
Pattern pattern = Pattern.compile("(?is)a.b+"); Pattern pattern = Pattern.compile("a.b+",Pattern.CASE_INSENSITIVE | Pattern.DOTALL);
下面介绍Pattern的主要成员方法:
1. static boolean matches(String regex.CharSequence input)
这个方法可以检验字符串input能否由正则表达式regex匹配,因为是静态方法,所以不需要编译生成各个对象,方便随手使用。要注意的是,它检验的是“整个字符串能否由表达式匹配”,而不是“表达式能否在字符串中找到匹配”。你可以认为regex的首尾自动加上了匹配字符串起始和结束位置的锚点 \A和\z 。
Pattern.matches("\\d{6}","a123456"); //false Pattern.matches("\\d{6}","123456"); //true
2. String[] split(CharSequence text)
通常,Pattern对象需要配合下面将要介绍的Matcher一起完成正则操作。如果只用正则表达式来切分字符串,只用Pattern的这个方法也可以。
这个方法接收的参数类型是CharSequence它可能有点陌生,其实它是String的父类,其他子类还有CharBuffer,StringBuffer,StringBuilder,因而可以应对常见的各种表示“字符串”的类。下面的代码仅以String为例:
String s = "2010-12-20"; Pattern pattern = Pattern.compile("\\s+"); for(String part : pattern.split(s)){ System.out.println(part); }
3. String[] split(CharSequence text,int limit)
这个方法与上面的方法很相似,只是多了一个参数limit,它用来限定返回的String数组的最大长度。也就是说,它规定了字符串至多只能“切”limit-1次。如果不需要对字符串比较大,进行尽可能多的切分,使用这个方法。
String s = " 2010-12-20 "; Pattern pattern = Pattern.compile("\\s+"); for(String part : Pattern.split(s,2)){ System.out.println(part); }
既然limit是一个int类型,那么它自然可以设定为各种值,下表总结了limit在各个取值区间对结果的影响(未指定limit时,最终返回包含n个元素的数组,实际能切分的次数是 n-1 ):
取值 |
结果 |
limit ffb14e3a63d532ba1d6ec8129b85ee56= n |
等于未指定limit时 |
4. static String quote(String text)
这个方法用来取消字符串text中所有转义字符的特殊含义,实质就是在字符串首尾添加 \Q 和 \E。通常,如果需要把某个字符串作为没有任何特殊意义的正则表达式(比如从外界读入的字符串,用在某个复杂的正则表达式中),就可以使用这个方法:
"aacb".matches("a*.b"); //true "a*.b".matches("a*.b"); //false "a*.b".matches("a*.b"); //false "a*.b".matches(Pattern.quote("a*.b")); //true
Matcher
Matcher可以理解为“某次具体匹配的结果对象”:把编译好的Pattern对象“应用”到某个String对象上,就获得了作为“本次匹配结果”的Matcher对象。之后,就可以通过它获得关于匹配的信息。
Pattern pattern = Pattern.compile("\\d{4}-\\d{2}-\\d{2}"); Matcher matcher = pattern.matcher("2010-12-20 2011-02-14"); while(matcher.find()){ System.out.println(matcher.group()); }
对编译好的Pattern对象调用matcher(String text)方法,传入要匹配的字符串text,就得到了Matcher对象,每次调用一次find()方法,如果返回true,就表示“找到一个匹配”,此时可以通过下面的若干方法获得关于本次匹配的信息。
1. String group(int n)
返回当前匹配中第n对捕获括号捕获的文本,如果n为0,则取匹配的全部内容;如果n小于0或者大于最大分组编号数,则报错。
2. String group()
返回当前匹配的全部文本,相当于group(0)。
3. int groupCount()
返回此Matcher对应Pattern对象中包含的捕获分组数目,编号为0的默认分组不计在内。
4. int start(n)
返回当前匹配中第n对捕获括号匹配的文本在原字符串中的起始位置。
5. int start()
返回当前匹配的文本在原字符串中的起始位置,相当于start(0)。
6. int end(n)
返回当前匹配中第n对捕获括号匹配的文本在原字符串中的结束位置。
7. int end()
返回当前匹配的文本在原字符串中的结果位置,相当于end(0)。
8. String replaceAll(String replacement)
如果进行正则表达式替换,一般用到的是Matcher的replaceAll()方法,它会将原有文本中正则表达式能匹配的所有文本替换为replaceement字符串。
String
许多时候只需要临时使用某个正则表达式,而不需要重复使用,这时候每次都生成Pattern对象和Matcher对象再操作显得很烦琐。所以,Java的String类提供了正则表达式操作的静态成员方法,只需要String对象就可以执行正则表达式操作。
1. boolean matches(String regex)
这个方法判断当前的string对象能否由正则表达式regex匹配。请注意,这里的“匹配”指的并不是regex能否在String内找到匹配,而是指regex匹配整个String对象,因此非常适合用来做数据校验。
"123456".matches("\\d{6}"); //true "a123456".matches("\\d{6}"); //true
2. String replaceFirst(String regex,String replacement)
这个方法用来替换正则表达式regex在字符串中第一次能匹配的文本,可以在replacement字符串中用$num引用regex中对应捕获分组匹配的文本。
"2010-12-20 2011-02-14".replaceFirst("(\\d{4})-(\\d{2})-(\\d{2})","$2/$3/$1");
3. String replaceAll(String regex,String replacement)
这个方法用来进行所有的替换,它的结果等同于Matcher类的replaceAll()方法,replacement字符串中也可以用$num的表示法引用regex中对应捕获分组匹配的文本。
"2010-12-20 2011-02-14".replaceAll("(\\d{4})-(\\d{2})-(\\d{2})","$2/$3/$1");
4. String[] split(String regex)
这个方法等价于Pattern中对应的split()方法,此处不再赘述。
5. String[] split(String regex,int limit)
这个方法等价于Pattern中对应的split()方法,此处不再赘述。
以上是详解Java正则表达式API的详细内容。更多信息请关注PHP中文网其他相关文章!

本文讨论了使用Maven和Gradle进行Java项目管理,构建自动化和依赖性解决方案,以比较其方法和优化策略。

本文使用Maven和Gradle之类的工具讨论了具有适当的版本控制和依赖关系管理的自定义Java库(JAR文件)的创建和使用。

本文讨论了使用咖啡因和Guava缓存在Java中实施多层缓存以提高应用程序性能。它涵盖设置,集成和绩效优势,以及配置和驱逐政策管理最佳PRA

本文讨论了使用JPA进行对象相关映射,并具有高级功能,例如缓存和懒惰加载。它涵盖了设置,实体映射和优化性能的最佳实践,同时突出潜在的陷阱。[159个字符]

Java的类上载涉及使用带有引导,扩展程序和应用程序类负载器的分层系统加载,链接和初始化类。父代授权模型确保首先加载核心类别,从而影响自定义类LOA

本文解释了用于构建分布式应用程序的Java的远程方法调用(RMI)。 它详细介绍了接口定义,实现,注册表设置和客户端调用,以解决网络问题和安全性等挑战。

本文详细介绍了用于网络通信的Java的套接字API,涵盖了客户服务器设置,数据处理和关键考虑因素,例如资源管理,错误处理和安全性。 它还探索了性能优化技术,我

本文详细介绍了创建自定义Java网络协议。 它涵盖协议定义(数据结构,框架,错误处理,版本控制),实现(使用插座),数据序列化和最佳实践(效率,安全性,维护


热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

AI Hentai Generator
免费生成ai无尽的。

热门文章

热工具

VSCode Windows 64位 下载
微软推出的免费、功能强大的一款IDE编辑器

SublimeText3 Mac版
神级代码编辑软件(SublimeText3)

SecLists
SecLists是最终安全测试人员的伙伴。它是一个包含各种类型列表的集合,这些列表在安全评估过程中经常使用,都在一个地方。SecLists通过方便地提供安全测试人员可能需要的所有列表,帮助提高安全测试的效率和生产力。列表类型包括用户名、密码、URL、模糊测试有效载荷、敏感数据模式、Web shell等等。测试人员只需将此存储库拉到新的测试机上,他就可以访问到所需的每种类型的列表。

SublimeText3 英文版
推荐:为Win版本,支持代码提示!

Dreamweaver CS6
视觉化网页开发工具