
本文详解如何在Java中准确识别并处理以特定数量星号(如 ***)开头的行,避免因 contains() 误匹配更短的子串(如单个 *),并提供基于正则表达式、indexOf 循环及流式处理的可靠实现方案。
本文详解如何在java中准确识别并处理以特定数量星号(如 `***`)开头的行,避免因 `contains()` 误匹配更短的子串(如单个 `*`),并提供基于正则表达式、`indexof` 循环及流式处理的可靠实现方案。
在文本处理场景中,常需根据行首星号数量(如 *、**、***)进行结构化解析或内容拼接。但直接使用 String.contains("***") 并不能满足“精确匹配三个连续星号”的需求——它仅判断子串是否存在,无法区分 *** 是独立出现还是嵌套在 **** 或被其他星号干扰的上下文中;更关键的是,contains() 本身不会产生误匹配(例如 "*".contains("***") 恒为 false),真正的问题在于:开发者常误用 contains() 判断“行是否以 N 个星号开头”,而该方法完全不关心位置和边界。
要实现题设目标——将所有以 *** 开头的行提取并拼接到原文末尾(且不误选 * 或 ** 行),核心是 精确匹配行首的连续星号数量。以下是三种推荐方案:
✅ 方案一:正则表达式(最清晰、语义明确)
使用 ^\*{3} 精确匹配行首三个星号(^ 锚定开头,\*{3} 匹配字面量 ***,双反斜杠转义):
import java.util.*;
import java.util.regex.Pattern;
public class StarMatcher {
private static final Pattern TRIPLE_STAR_LINE = Pattern.compile("^\*{3}(.*)");
public static List<string> extractTripleStarLines(String text) {
return Arrays.stream(text.split("
"))
.map(String::trim)
.filter(line -> !line.isEmpty())
.map(TRIPLE_STAR_LINE::matcher)
.filter(Matcher::find)
.map(m -> m.group(1).trim()) // 提取 *** 后的内容
.toList();
}
public static String process(String input) {
String[] lines = input.split("
");
StringBuilder result = new StringBuilder();
List<string> tripleStarContents = new ArrayList();
for (String line : lines) {
String trimmed = line.trim();
if (trimmed.startsWith("***")) {
// 确保是恰好三个,且后跟非星号或行尾(防 ****)
if (trimmed.length() == 3 || trimmed.charAt(3) != '*') {
tripleStarContents.add(trimmed.substring(3).trim());
}
} else {
result.append(line).append("
");
}
}
// 追加所有匹配内容(带 *** 前缀)
for (String content : tripleStarContents) {
result.append("***").append(content).append("
");
}
return result.toString().trim();
}
}</string></string>
✅ 方案二:indexOf + 边界校验(零依赖、高效)
避免正则开销,用 String.indexOf("***") 配合位置检查:
在 Java 中初始化和管理阿里云 SDK客户端。包括单例模式、线程安全、endpoint 与 region 配置、VPC 终端节点、同步与异步等。
public static boolean startsWithExactlyThreeStars(String line) {
if (line == null || line.length() 3 && line.charAt(3) == '*')
return false;
return true;
}
✅ 方案三:流式处理(现代简洁风格)
结合 Stream 和 Pattern 实现函数式链式调用:
import java.util.regex.Pattern;
import java.util.stream.Collectors;
public static String concatTripleStarLines(String input) {
String[] allLines = input.split("
");
String nonTripleLines = Arrays.stream(allLines)
.filter(line -> !line.trim().matches("^\*{3}[^*].*")) // 排除 *** 开头的行
.collect(Collectors.joining("
"));
String tripleStarLines = Arrays.stream(allLines)
.filter(line -> line.trim().matches("^\*{3}(.*)"))
.map(line -> line.trim().replaceFirst("^\*{3}\s*", "***")) // 标准化空格
.collect(Collectors.joining("
"));
return nonTripleLines + (nonTripleLines.isEmpty() ? "" : "
") + tripleStarLines;
}
⚠️ 关键注意事项
-
contains()不是位置敏感方法:它只回答“子串是否存在”,无法替代“是否以某前缀开头”——应改用startsWith()或正则。 -
警惕贪婪匹配:
"****".startsWith("***")返回true,若需“恰好三个”,必须额外校验第4位(如示例中的charAt(3) != '*')。 -
空格与换行鲁棒性:实际文本常含前后空格,务必先
trim()再判断。 -
性能考量:对超大文本,优先选择
startsWith()+ 手动字符比对(O(1));对复杂模式(如支持***text和*** text),正则更可靠。
综上,解决该问题的本质是从“包含子串”思维转向“结构化前缀匹配”思维。选用任一上述方案,均可精准分离并重组 *** 行,彻底规避 * 或 ** 的干扰匹配。
Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南










