C++如何实现不区分大小写的字符串比较 _ stricmp与自定义比较【干货】

阿瑶姑娘_8030

阿瑶姑娘_8030

2026-04-29

646人浏览

原创

\_stricmp是windows下快速不区分大小写比较的便捷方案,但仅限ascii、不支持utf-8、非标准c++且易因nullptr或locale问题崩溃;跨平台应使用带locale的std::equal或icu等unicode库。

c++如何实现不区分大小写的字符串比较 _ stricmp与自定义比较【干货】

用 _stricmp 做 Windows 下快速不区分大小写比较

Windows 平台直接调 _stricmp 是最省事的方案,它等价于 POSIX 的 strcasecmp,但注意不是标准 C++ 函数,跨平台会报错。

常见错误是传入 nullptr 或未终止的字符串,_stricmp 会崩溃;另外它只对 ASCII 字符可靠,遇到 UTF-8 字节序列(比如中文或带重音的拉丁字母)会按字节逐个比,结果不可靠。

使用时只需:

int result = _stricmp("Hello", "HELLO"); // 返回 0 表示相等
if (result == 0) { /* 匹配 */ }
  • 仅限 MSVC/MinGW 编译器,GCC/Clang 在 Windows 上需定义 _CRT_NONSTDC_NO_DEPRECATE 才能启用
  • 不能用于 std::string 对象,得先调 c_str()
  • 对含非 ASCII 字符的字符串(如 "café" vs "CAFÉ")不保证正确,因为大小写映射依赖 locale,而 _stricmp 默认用 "C" locale

用 std::equal + std::tolower 实现可移植自定义比较

标准 C++ 推荐方式:把两个字符串转成小写再逐字符比,或用 std::equal 配合自定义谓词。关键是必须指定 locale,否则 std::tolower(int, locale) 对非 ASCII 字符行为未定义。

典型坑点:直接用 std::tolower(char)(无 locale 版本)会导致符号扩展问题——当 char 是 signed 且值 >127 时,传给 int 会变成负数,std::tolower 不接受负输入,返回未定义值。

安全写法:

C++ Code Review Master
C++ Code Review Master

组合式C++代码评审方案,融合静态分析、AI推理、多轮迭代评审和C++专项检查,适用于PR审查、增量代码审查、全项目评审和代码质量评分,触发词包括review cpp、cpp代码评审、C++review、代码审查。

下载
bool iequals(const std::string& a, const std::string& b) {
    if (a.size() != b.size()) return false;
    auto loc = std::locale(""); // 使用系统当前 locale
    return std::equal(a.begin(), a.end(), b.begin(),
        [&loc](char x, char y) {
            return std::tolower(static_cast<unsigned char>(x), loc) ==
                   std::tolower(static_cast<unsigned char>(y), loc);
        });
}</unsigned></unsigned>
  • 必须用 static_cast<unsigned char></unsigned> 防止符号扩展
  • std::locale("") 在 Linux/macOS 通常生效,在 Windows 可能 fallback 到 "C",建议显式传 std::locale("en_US.UTF-8")(如果系统支持)
  • 性能比 _stricmp 略低,因每次调用都查 locale 表;若频繁调用,可提前缓存 std::ctype<char>&</char>

处理 UTF-8 字符串时不要硬套 ASCII 方法

如果你的字符串实际是 UTF-8 编码(比如从文件、网络或现代编辑器读入),_stricmp 和基于 char 的 std::tolower 都会出错——它们把多字节 UTF-8 当作独立字节处理,可能拆开一个汉字或重音字母,导致越界或乱码比较。

此时没有标准库捷径,必须先做 Unicode 正规化(NFC),再转小写,再比较。轻量级方案是用 utf8cpp 库或 ICU:

// 示例:用 utf8cpp + ICU 风格逻辑(伪代码)
std::string normalized_a = utf8_normalize_nfc(a);
std::string lower_a = utf8_to_lower(normalized_a);
// ……同理处理 b,再用 == 比较
  • 别自己写 UTF-8 解码循环——边界条件极难覆盖(如代理对、组合字符、ZWNJ 等)
  • 即使只处理西欧语言,"ß"(德语)小写就是它自己,但大写是 "SS",ASCII 方法完全无法处理这种 1:2 映射
  • 若项目已用 Qt,直接上 QString::compare(..., Qt::CaseInsensitive),它内部做了完整 Unicode 处理

什么时候该用 std::lexicographical_compare 而不是 ==

不区分大小写的“相等”只是需求之一;更多场景要的是排序或查找(比如 std::map<:string t iless></:string>),这时需要严格弱序,不能只写个相等判断。

std::lexicographical_compare 是正确选择,但它不像 == 那样有隐式转换,必须手动控制两个字符串的迭代器长度和比较逻辑:

struct iless {
    bool operator()(const std::string& a, const std::string& b) const {
        return std::lexicographical_compare(
            a.begin(), a.end(), b.begin(), b.end(),
            [](char x, char y) {
                auto loc = std::locale("");
                return std::tolower(static_cast<unsigned char>(x), loc) (y), loc);
            }
        );
    }
};</unsigned>
  • 上面写法每次比较都新建 locale 对象,效率差;应把 locale 提到成员变量并初始化一次
  • 若字符串大量重复且长度差异大,可先比长度(短的字典序更小),但要注意 "aa"
  • 别在 lambda 里用 std::tolower(int) 无 locale 版本——它不处理 locale,且对 >127 的值未定义

Unicode 大小写映射的复杂性远超多数人预期,哪怕只支持英文,也要防住 "İ"(带点大写 I,土耳其语)这类例外。真要健壮,就别绕开 ICU 或成熟 Unicode 库。

C++免费学习笔记(深入):立即使用
在学习笔记中,你将探索 C++ 的入门与实战技巧!

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

c++

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
C语言变量命名
C语言变量命名

c语言变量名规则是:1、变量名以英文字母开头;2、变量名中的字母是区分大小写的;3、变量名不能是关键字;4、变量名中不能包含空格、标点符号和类型说明符。php中文网还提供c语言变量的相关下载、相关课程等内容,供大家免费下载使用。

2023.06.20

2949

3

c语言入门自学零基础
c语言入门自学零基础

C语言是当代人学习及生活中的必备基础知识,应用十分广泛,本专题为大家c语言入门自学零基础的相关文章,以及相关课程,感兴趣的朋友千万不要错过了。

2023.07.25

2228

9

c语言运算符的优先级顺序
c语言运算符的优先级顺序

c语言运算符的优先级顺序是括号运算符 > 一元运算符 > 算术运算符 > 移位运算符 > 关系运算符 > 位运算符 > 逻辑运算符 > 赋值运算符 > 逗号运算符。本专题为大家提供c语言运算符相关的各种文章、以及下载和课程。

2023.08.02

1180

5

c语言数据结构
c语言数据结构

数据结构是指将数据按照一定的方式组织和存储的方法。它是计算机科学中的重要概念,用来描述和解决实际问题中的数据组织和处理问题。数据结构可以分为线性结构和非线性结构。线性结构包括数组、链表、堆栈和队列等,而非线性结构包括树和图等。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2023.08.09

1138

4

c语言random函数用法
c语言random函数用法

c语言random函数用法:1、random.random,随机生成(0,1)之间的浮点数;2、random.randint,随机生成在范围之内的整数,两个参数分别表示上限和下限;3、random.randrange,在指定范围内,按指定基数递增的集合中获得一个随机数;4、random.choice,从序列中随机抽选一个数;5、random.shuffle,随机排序。

2023.09.05

1316

5

c语言const用法
c语言const用法

const是关键字,可以用于声明常量、函数参数中的const修饰符、const修饰函数返回值、const修饰指针。详细介绍:1、声明常量,const关键字可用于声明常量,常量的值在程序运行期间不可修改,常量可以是基本数据类型,如整数、浮点数、字符等,也可是自定义的数据类型;2、函数参数中的const修饰符,const关键字可用于函数的参数中,表示该参数在函数内部不可修改等等。

2023.09.20

2058

7

c语言get函数的用法
c语言get函数的用法

get函数是一个用于从输入流中获取字符的函数。可以从键盘、文件或其他输入设备中读取字符,并将其存储在指定的变量中。本文介绍了get函数的用法以及一些相关的注意事项。希望这篇文章能够帮助你更好地理解和使用get函数 。

2023.09.20

3260

8

c数组初始化的方法
c数组初始化的方法

c语言数组初始化的方法有直接赋值法、不完全初始化法、省略数组长度法和二维数组初始化法。详细介绍:1、直接赋值法,这种方法可以直接将数组的值进行初始化;2、不完全初始化法,。这种方法可以在一定程度上节省内存空间;3、省略数组长度法,这种方法可以让编译器自动计算数组的长度;4、二维数组初始化法等等。

2023.09.22

14555

6

c语言中null和NULL的区别
c语言中null和NULL的区别

c语言中null和NULL的区别是:null是C语言中的一个宏定义,通常用来表示一个空指针,可以用于初始化指针变量,或者在条件语句中判断指针是否为空;NULL是C语言中的一个预定义常量,通常用来表示一个空值,用于表示一个空的指针、空的指针数组或者空的结构体指针。

2023.09.22

549

3

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Conan 2 Essentials 免费课程
Conan 2 Essentials 免费课程

共0课时 | 0人学习

CMake 与 Conan 集成实践
CMake 与 Conan 集成实践

共0课时 | 0人学习

Conan 2 高级依赖模型介绍
Conan 2 高级依赖模型介绍

共0课时 | 0人学习