不能共用同一正则匹配链接和图片,因!\[alt\](url)与\[text\](url)语义不同:未区分!前缀会导致误判类型、替换错乱;!未转义易引发引擎行为不一致;混用url处理逻辑(如cdn重写vs协议加固)将失控。

直接用同一个正则同时匹配链接和图片,会出错——因为  和 [text](url) 结构相似但语义不同,不加区分地替换,容易把图片误当成普通链接处理,或者漏掉其中一类。
为什么不能共用 /$$([^$$]*)$$$([^)]+)$/ 匹配所有括号链接
这个正则看似能抓到 [a](b) 和 ,但它无法区分前缀字符(! 是否存在),导致:
- 替换时无法判断该位置是图片还是链接,
alt文本可能被当作文本链接的显示文字误改 - 若只做全局 URL 替换(比如加 CDN 前缀),图片 URL 和链接 URL 通常要走不同逻辑,混在一起就失控
- 正则中未转义
!,实际匹配时!是特殊字符,不加\!会导致部分引擎行为不一致(尤其 PCRE 默认贪婪模式下易漏匹配)
分开匹配:用两个正则,各自处理各自语义
安全做法是显式拆开,用不同 pattern 分别捕获图片和链接:
图片匹配用:/!\[([^$$]*)\]\(([^)]+)\)/
链接匹配用:/\[([^$$]*)\]\(([^)]+)\)/
两者唯一区别就是开头是否带 \!,其余结构完全一致,便于复用替换逻辑。
实操建议:
- 先用
preg_match_all分别提取两类匹配项,拿到$matches[1](alt/text)和$matches[2](url) - 对图片 URL 做路径重写(如
./img/a.png → /cdn/blog/a.png),对链接 URL 可能只需协议加固(如http:// → https://) - 用
preg_replace_callback逐个替换,避免索引偏移问题——PHP 的 callback 自动按原始位置替换,不手动算 offset
替换时保留原格式,避免破坏嵌套或转义
Markdown 中图片 alt 文本可能含括号、反斜杠甚至 HTML 实体,直接拼接字符串极易出错。正确做法是让正则捕获完整结构,再在回调里重建:
preg_replace_callback(
'/!\[([^$$]*)\]\(([^)]+)\)/',
function ($m) {
$alt = $m[1];
$url = $m[2];
// 这里做 URL 转换,例如:
$newUrl = str_replace('./images/', '/cdn/images/', $url);
return '';
},
$markdown
);
注意点:
- 不要用
str_replace或多次preg_replace直接改字符串,否则里的(或)可能被其他规则误伤 - 如果 url 含查询参数(如
?v=1),确保正则中的[^)]+仍能覆盖——它已足够,因为)是合法 URL 终止符,不会出现在参数值里 - 若原文有转义括号(如
\(),上述正则不处理,这是合理取舍;真有这种边缘情况,应先预处理转义序列
遇到懒加载图片或 data-src 怎么办
这不是 Markdown 语法,而是 HTML 残留。如果你的输入源其实是 HTML(比如从富文本编辑器导出),那 <img src="..."> 或 <img> 不会被上面任一正则捕获。
此时需要额外一步:
- 先用
/<img>]*src\s*=\s*[\'"]([^\'"]+)[\'"][^>]*>/i提取src - 或扩展为支持
data-src:/<img>]*(?:src|data-src)\s*=\s*[\'"]([^\'"]+)[\'"][^>]*>/i - 再把提取到的 URL 构造成
插入原文对应位置——这已超出纯正则替换范畴,需 DOM 解析或位置映射
真正容易被忽略的,是混合内容场景:一份文档里既有原生 Markdown 图片,又有 HTML img 标签,还有自定义短代码。这时候靠单个正则兜底,不如分层处理——先清理 HTML,再跑 Markdown 正则,最后补漏。顺序错了,后面全白干。
php免费学习视频:立即使用
踏上前端学习之旅,开启通往精通之路!从前端基础到项目实战,循序渐进,一步一个脚印,迈向巅峰!











