std::unique不能直接去重空格,因为它只压缩连续重复元素;对非连续空格无效,需先用unique压缩连续空格再手动trim首尾。

std::unique 为什么不能直接去重空格?
std::unique 不是“去重函数”,它只把**连续重复的元素压缩成一个**,并返回新逻辑结尾的迭代器。如果字符串是 "a b c"(多个不连续空格),std::unique 对非连续空格完全无效——它只看相邻元素是否相等。
常见误用:std::unique(str.begin(), str.end()) 后直接 erase,结果可能是 "a b c"(侥幸对了),但遇到 " a b " 就变成 " a b ",首尾多余空格还在,中间也可能漏掉。
真正起作用的是「连续重复」这个前提。空格必须挨着才被压缩。
正确做法:先压缩连续空格,再处理首尾
分两步走更可控:
- 用
std::unique+erase压缩所有连续空格为单个空格 - 再用
std::string::find_first_not_of和find_last_not_of截掉首尾空格
示例代码:
std::string s = " hello world ";
auto new_end = std::unique(s.begin(), s.end(), [](char a, char b) {
return a == ' ' && b == ' ';
});
s.erase(new_end, s.end());
<p>// 去首尾空格
size_t first = s.find_first_not_of(' ');
if (first == std::string::npos) {
s.clear();
} else {
size_t last = s.find_last_not_of(' ');
s = s.substr(first, last - first + 1);
}</p>
注意:lambda 中判断两个字符都是空格才视为“可合并”,避免把 ' ' 和 '\t' 错误合并(如果你需要保留其他空白符)。
想一步到位?用 std::regex_replace 更直观
如果项目允许 C++11 以上且不介意正则开销,std::regex_replace 更贴近“去除所有重复空格”的直觉:
s = std::regex_replace(s, std::regex(" +"), " "); // 连续空格→单空格
s = std::regex_replace(s, std::regex("^ +| +$"), ""); // 去首尾空格
但要注意:
- 正则在短字符串上比手写循环慢不少,高频调用慎用
- 某些嵌入式或禁用 STL regex 的环境不可用
-
std::regex在 MSVC 早期版本有 bug,GCC/Clang 更稳
为什么不用 std::remove_if?
std::remove_if 是删掉所有满足条件的字符,比如删掉所有空格——但这不是“去重”,是“全删”。若目标是“多空格变一空格”,它无法保留那个“该留下的空格”。
有人尝试组合:std::remove_if + 记录上一个字符状态,逻辑立刻变复杂,且易出错。不如老实用 unique(针对连续)或正则(针对模式)。
真正容易被忽略的是:空格去重从来不是孤立操作——它往往和 trim、单词分割、tokenize 混在一起。别只盯着 unique,先想清楚你要的是“规范空白”还是“彻底清理”,再选工具。
C++免费学习笔记(深入):立即使用
在学习笔记中,你将探索 C++ 的入门与实战技巧!











