“冗余后缀”指按业务规则需删除的重复或多余后缀,并非语法概念;例如末尾连续重复子串(如"data.json.json.json"→"data.json"),需先明确定义规则再实现,c++标准库无现成函数。

什么是“冗余后缀”?先明确你要删的到底是什么
很多同学一看到“删除冗余后缀”,下意识就去搜 std::string::rfind 或写循环从末尾匹配,结果删错了——因为“冗余”不是语法概念,而是业务定义。比如:
- 你指重复出现的相同后缀,如
"hello.txt.txt"→ 删成"hello.txt" - 还是说某个固定后缀(如
".tmp")只应保留一个,多出来的全干掉? - 又或者,是像
"a.b.c.c.c"这种点分段中末尾连续重复的段?
C++ 标准库没有现成函数做这类“语义化后缀去重”,必须自己界定规则再实现。
删连续重复后缀:用 rfind + substr 循环截取
适用场景:字符串末尾有连续、完全相同的子串,你想只留一个。例如 "data.json.json.json" → "data.json"。
关键思路是:不断检查末尾是否包含自身前缀,且该前缀长度能整除剩余长度。
实操建议:
- 先获取原始字符串长度
len,设suffix_len = len / 2为最大可能后缀长度(至少得有两个重复才叫冗余) - 从大到小遍历可能的后缀长度
i,用s.rfind(s.substr(len - i), 0) == len - i判断是否以该子串结尾且该子串在开头也存在(不严谨,仅适用于“前后一致”的简单情况) - 更稳妥的做法是:提取末尾候选后缀
cand = s.substr(len - i),然后反复erase直到末尾不再匹配cand
std::string remove_repeated_suffix(std::string s) {
size_t len = s.length();
if (len == 0) return s;
for (size_t i = 1; i <p>⚠️ 注意:<code>rfind</code> 返回的是最后一次出现位置,但你要确认它是不是真在“末尾”——所以得额外判断 <code>pos == s.length() - cand.length()</code>,否则会误删中间内容。</p><h3>删固定后缀多次出现:用 <code>while</code> + <code>ends_with</code>(C++20)或手动比对</h3><p>适用场景:你知道冗余的是某个特定后缀,比如日志文件名里多个 <code>".log"</code>,如 <code>"app.log.log.log"</code> → <code>"app.log"</code>。</p><div class="aritcle_card flexRow artxards">
<div class="artcardd flexRow">
<a class="aritcle_card_img" rel="nofollow" href="/xiazai/skill5502" title="C++ Code Review Master"><img
src="https://img.php.cn/upload/skill/000/000/081/179051228971575.jpg" alt="C++ Code Review Master" onerror="this.onerror='';this.src='/static/lhimages/moren/morentu.png'" ></a>
<div class="aritcle_card_info flexColumn">
<a rel="nofollow" href="/xiazai/skill5502" title="C++ Code Review Master" class="overflowclass">C++ Code Review Master</a>
<p class="overflowclass">组合式C++代码评审方案,融合静态分析、AI推理、多轮迭代评审和C++专项检查,适用于PR审查、增量代码审查、全项目评审和代码质量评分,触发词包括review cpp、cpp代码评审、C++review、代码审查。</p>
</div>
<a rel="nofollow" href="/xiazai/skill5502" title="C++ Code Review Master" class="aritcle_card_btn flexRow flexcenter"><b></b><span>下载</span>
</a>
</div>
</div><p>如果你用 C++20,直接上 <code>std::string::ends_with</code> 最清晰:</p><pre class="brush:php;toolbar:false;">void remove_multiple_suffix(std::string& s, const std::string& suffix) {
while (s.length() >= suffix.length() && s.ends_with(suffix)) {
s.erase(s.length() - suffix.length());
}
}如果是 C++17 或更早,得手写末尾比对:
bool ends_with(const std::string& s, const std::string& suffix) {
return s.length() >= suffix.length() &&
s.compare(s.length() - suffix.length(), suffix.length(), suffix) == 0;
}常见坑:
- 忘记检查长度,
s.length() 时调 <code>substr或compare会抛std::out_of_range - 用
find替代rfind或ends_with,导致删了开头或中间的匹配 - 修改字符串过程中没更新长度判断,造成越界或死循环
性能与边界:短字符串别过度优化,长文本注意 erase 的开销
std::string::erase 在末尾删除是 O(1) 均摊,但若反复调用(比如几千次),每次都要移动内部指针、检查容量,实际开销不小。
更高效的做法是:一次扫描确定最终长度,最后只做一次 resize:
std::string remove_trailing_duplicates(const std::string& s, const std::string& suffix) {
size_t end = s.length();
while (end >= suffix.length() &&
s.compare(end - suffix.length(), suffix.length(), suffix) == 0) {
end -= suffix.length();
}
return s.substr(0, end);
}
这个版本不改原串,避免多次内存操作;返回新串也更符合函数式习惯。不过要注意:如果 suffix 是空串,compare 会出错——务必提前校验输入。
真正难的不是写代码,是和产品/日志规范对齐:那个“冗余”,到底是按字面重复算,还是按语义(比如忽略大小写、忽略点号前后空格)算。这些逻辑一旦定错,删掉的可能就是有效数据。
C++免费学习笔记(深入):立即使用
在学习笔记中,你将探索 C++ 的入门与实战技巧!










