sublime中查找与替换的捕获组语法不同:查找用\1反向引用,替换用$1插值;命名组仅支持(?p...),替换时用$name;编号严格按左括号顺序;跨行匹配需开启“. matches newline”。

Sublime里查找和替换用的不是同一套捕获组语法
查找时反向引用必须写成 \1、\2,而替换时必须写成 $1、$2。混用会直接失效——比如在替换框里写 \1,Sublime 会原样输出字面量 \1,而不是插入第一组内容。
这是因为 Sublime 查找引擎基于 Python re 模块,但查找和替换两个字段的解析逻辑是分离的:查找阶段支持 \1 这类反向引用用于匹配控制(比如匹配重复单词 (\w+)\s+\1),而替换阶段只认 $1 这种变量插值语法。
- 查找框输入
(\d{4})-(\d{2})-(\d{2})→ 匹配成功后内存中存了三组 - 想在查找中复用第一组内容做限定?用
\1,例如(\d{4})-(\d{2})-(\d{2})\s+\1匹配“2025-01-01 2025” - 替换框里要调换顺序?只能写
$3/$2/$1,写\3/\2/\1就白忙活 - 需要输出字面量
$1?写成$$1
命名捕获组只支持 (?P<name>)</name> 写法
Sublime 支持命名捕获,但仅限 Python 风格的 (?P<name>...)</name>,不支持 (?'name'...) 或 (?<name>...)</name> 等其他变体。命名后替换中用 $name 引用,比编号更直观,尤其在嵌套或多个括号时不容易数错。
例如日期转换:(?P<year>\d{4})-(?P<month>\d{2})-(?P<day>\d{2})</day></month></year>,替换为 $month/$day/$year。注意命名不能含空格或特殊字符,且不能和编号组混用导致歧义。
- 有效命名:
(?P<id>\d+)</id>、(?P<email>[^\s@]+@[^\s@]+\.[^\s@]+)</email> - 无效写法:
(?'id'\d+)、(?<id>\d+)</id>、(?P<user name>\w+)</user> - 命名组也参与编号顺序:若前面有未命名组,命名组仍按左括号位置得编号,比如
(\w+)(?P<ext>\.\w+)</ext>中$1是文件名,$2和$ext都指向扩展名
嵌套括号的编号严格按左括号出现顺序
像 ((\w+),\s*(\w+)) 这种结构,编号不是按“层”而是按“(”从左到右逐个计数:最外层 ((...)) 是 $1,内层第一个 (\w+) 是 $2,第二个 (\w+) 是 $3。很多人误以为外层是 $1、内层整体是 $2、再里面是 $3,其实只要括号出现就占一个号。
这种编号规则在处理 HTML 标签或函数调用时特别容易踩坑。比如想提取 <div class="foo">...</div> 中的 class 值,写成 <div>]*>(.*)</div>,那么 $1 是 class 值,$2 是内容,但如果你多加了一对括号去“保险”,编号全乱了。
- 检查编号是否正确:先在查找框中测试,把光标停在匹配结果上,看状态栏是否显示类似 “Match: ..., Groups: 3”
- 不需要捕获的括号,一律加
?:,如(?:https?://),既避免编号干扰,也提升性能 - 复杂嵌套建议拆成多步操作,别硬塞进一个正则里
跨行匹配必须手动开启 . 匹配换行符
默认情况下,点号 . 不匹配换行符,所以 (.*) 只能捕获单行内容。如果要匹配多行(比如提取 HTML 块、JSON 对象、注释段),必须点击查找面板右下角的 .* 按钮旁的 \n 图标(或勾选 . matches newline)。
这个选项影响所有点号行为,包括 .*、.+、[\s\S]* 等惯用写法。不开它,哪怕正则本身语法完全正确,也会在跨行处截断,导致捕获组内容不全或匹配失败。
- 常见误判:写
<script>([\s\S]*)</script>却没开换行匹配,结果只拿到第一行 - 更稳妥写法:
<script>((?s:.)*?)</script>,其中(?s:.)*?是内联标志,等效于开启. matches newline,但只作用于当前组 - 开启后注意性能:
.*会贪婪匹配到文件末尾,建议配合非贪婪.*?或明确边界
\n 图标。这些地方一错,整个正则就静默失效,很难 debug。











