本文详解如何在Java中正确使用正则表达式匹配并删除每行的首字符,重点解决^.默认不跨行生效的问题,通过启用Pattern.MULTILINE标志实现逐行匹配,并提供可直接运行的完整代码示例。
本文详解如何在java中正确使用正则表达式匹配并删除每行的首字符,重点解决`^.`默认不跨行生效的问题,通过启用`pattern.multiline`标志实现逐行匹配,并提供可直接运行的完整代码示例。
在处理多行文本时,正则表达式 ^. 看似能匹配每行开头的字符,但在 Java 的 String.replaceAll() 中,默认不启用多行模式(multiline mode),导致 ^ 仅匹配整个字符串的绝对开头,而非每一行的起始位置——这正是原代码只删掉了第一行首字符、第二行未被处理的根本原因。
要让 ^ 正确识别每一行的开始,必须启用 MULTILINE 模式。Java 提供两种等效方式:
✅ 方式一:使用 Pattern.compile() + Matcher(推荐,更可控)
import java.util.regex.Pattern;
import java.util.regex.Matcher;
public class RemoveFirstCharPerLine {
public static void main(String[] args) {
String inString = "Z302052023CFCL11 0000.000000000 249999.990 0999999990000.000000000 0000.000000000 0000.000000000 0000.000000000\n" +
"Z302052023CFCL11 0000.000000000 249999.990 0999999990000.000000000 0000.000000000 0000.000000000 0000.000000000";
// 启用 MULTILINE 标志,使 ^ 匹配每行开头
Pattern pattern = Pattern.compile("^.", Pattern.MULTILINE);
String result = pattern.matcher(inString).replaceAll("");
System.out.println(result);
/* 输出:
302052023CFCL11 0000.000000000 249999.990 0999999990000.000000000 0000.000000000 0000.000000000 0000.000000000
302052023CFCL11 0000.000000000 249999.990 0999999990000.000000000 0000.000000000 0000.000000000 0000.000000000
*/
}
}
✅ 方式二:使用内联标志 (?m)(简洁写法)
String result = inString.replaceAll("(?m)^.", "");
(?m) 是内联标志,等价于 Pattern.MULTILINE,可直接嵌入正则表达式中,无需额外编译 Pattern 对象。
⚠️ 注意事项
- ❌ inString.replaceAll("^.", "") 无效:因未启用多行模式,^ 只匹配字符串最开头。
- ✅ 换行符必须为 \n(Unix/Linux/macOS)或 \r\n(Windows);Java 的 Pattern.MULTILINE 对 \n、\r\n、\r 均有效。
- ? 若需保留换行结构(如处理文件内容),上述方法天然支持;若输入含 Windows 风格 \r\n,无需额外处理。
- ? 扩展用法:若需提取首字符(而非删除),可用 Pattern.compile("^(.)", Pattern.MULTILINE) 并调用 matcher.find() 遍历捕获组 $1。
总之,Pattern.MULTILINE 是解锁 ^ 和 $ 行级锚点能力的关键开关。掌握它,才能真正实现“对每一行执行正则操作”的需求——这是文本预处理、日志清洗、格式标准化等场景中的基础而核心的技能。
Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南











