has_consecutive_dup函数通过at()遍历至length()-1检查相邻字符相等,空或单字符返回false,越界抛出异常确保安全。

用 std::string::at() 遍历比较相邻字符
最直接的办法是遍历字符串,逐个检查当前字符是否等于下一个字符。注意边界:最后一个字符没有“下一个”,所以循环只需到 str.length() - 1。
- 使用
at()比[]更安全,越界会抛出std::out_of_range(调试时有用) - 如果确定输入可信,用
[]略快,但无实质性优势 - 空字符串或单字符字符串直接返回
false
bool has_consecutive_dup(const std::string& s) {
if (s.length() <h3>用 <code>std::adjacent_find()</code> 一行解决</h3><p>STL 提供了专门处理“相邻相等”问题的算法:<code>std::adjacent_find</code>。它返回第一个满足“与后继相等”的迭代器,找不到则返回 <code>end()</code>。</p>
- 语义清晰,意图明确,比手写循环更不易出错
- 底层仍是线性扫描,性能和手写循环基本一致
- 默认比较用
==,如需自定义(比如忽略大小写),可传入二元谓词
#include <algorithm>
bool has_consecutive_dup(const std::string& s) {
return std::adjacent_find(s.begin(), s.end()) != s.end();
}</algorithm>
遇到中文或 UTF-8 多字节字符怎么办
std::string 在 C++ 中本质是字节序列,std::adjacent_find 或 at() 比较的是单个 char —— 也就是一个字节。对 UTF-8 编码的中文,一个汉字占 3 字节,直接按字节比会出错(比如把半个汉字当重复)。
- 若输入确定是 ASCII(纯英文、数字、符号),完全无需担心
- 若可能含 UTF-8 中文,必须先做 Unicode 层面的字符解码(例如用
std::wstring_convert已弃用;推荐utf8cpp库或 C++20 的<charconv></charconv>+std::u8string) - 简单绕过方案:只对已知为 ASCII 的字段用上述方法;对可能含中文的字段,先转成
std::vector<char32_t></char32_t>再查相邻
性能敏感场景下的注意事项
如果字符串极长(比如 MB 级日志文本),且多数情况下重复出现在开头,早返回策略就很重要 —— 上述两种方法都满足。但要注意:
- 避免在循环里调用
s.length()多次(虽然现代编译器常优化掉,但显式缓存更稳妥) - 不要用
std::string::substr()切片再比较,会触发内存分配和拷贝 - 如果需要统计重复次数或位置,别反复调用
adjacent_find,改用一次遍历记录信息
真正容易被忽略的是编码假设:没人告诉你输入一定是 ASCII,但代码却按字节跑 —— 这类 bug 往往在线上环境、特定用户输入时才暴露。
C++免费学习笔记(深入):立即使用
在学习笔记中,你将探索 C++ 的入门与实战技巧!











