C++如何使用std::execution进行并行算法加速

千杰君_4150

千杰君_4150

2026-06-03

537人浏览

原创

c++oding="utf-8" ?>

std::execution::par对std::sort或std::transform无加速甚至更慢,是因为它仅在数据量大(≥50万)、硬件多核、编译器启用并发支持(如gcc需-fopenmp)、stl实现支持(libc++至今不支持)且优化等级足够(-o2以上)时才生效;否则静默退化为串行。

c++如何使用std::execution进行并行算法加速

直接加 std::execution::par 到 std::sort 或 std::transform 上,大概率不会变快,甚至更慢或崩溃——这不是写法错,是并行策略本身不自动“加速”,它只在数据、硬件、编译器、算法四者严丝合缝时才生效。

为什么 std::execution::par 调用后毫无加速?

常见现象:CPU 单核 100%、耗时没降、htop 看不到多线程活动。根本原因不是代码有 bug,而是策略被静默降级为串行。

  • libstdc++(GCC)默认不启用并行后端,必须显式链接 -fopenmp 或 -D_GLIBCXX_PARALLEL,否则 par 直接退化为 seq
  • libc++(Clang)截至 2026 年 4 月仍基本不支持 std::execution::par,传了也无效
  • MSVC 需开启 /qpar 且仅部分算法(如 transform)真正启用,并行 sort 在 17.4+ 才较稳定
  • Debug 构建(-O0)下,所有主流 STL 实现都会禁用并行路径;必须用 -O2 或更高且定义 NDEBUG
  • std::thread::hardware_concurrency() 返回 0 或 1(如容器环境、CI 机器限制),par 必然不触发

哪些算法真能并行且相对安全?

别信“支持列表”,要看实际实现稳定性。目前经过 libstdc++ 12+、MSVC 2022 17.4+ 和 libc++ 15+ 充分验证的只有这几个:

C++ Code Review Master
C++ Code Review Master

组合式C++代码评审方案,融合静态分析、AI推理、多轮迭代评审和C++专项检查,适用于PR审查、增量代码审查、全项目评审和代码质量评分,触发词包括review cpp、cpp代码评审、C++review、代码审查。

下载
  • std::transform:纯函数式映射,par_unseq 效果最明显(SIMD + 多线程)
  • std::reduce:要求二元操作满足结合律(+ 可以,- 不行),初始值类型必须匹配
  • std::for_each:仅当 lambda 无副作用(不改全局、不调非 const 成员、不 push_back 同一容器)才安全
  • std::inclusive_scan / std::exclusive_scan:前缀和类操作,par 可用,par_unseq 尚未广泛验证

std::sort 和 std::stable_sort 虽语法支持,但行为高度依赖实现:GCC 的并行排序仍不如 TBB;MSVC 更成熟,但小数据(v.size() )必慢;<code>par_unseq 对 sort 是危险选项——它破坏顺序语义,而排序内部有强依赖,极易触发未定义行为。

怎么写才能让 par_unseq 真正起效?

par_unseq 不是 “更强的 par”,它是向量化 + 多线程混合模型,对代码约束极严。

  • lambda 必须是纯函数:不能捕获局部栈地址([&x] 错,[x] 可)、不能调 std::cout、不能修改任何外部状态
  • 底层内存需对齐:std::vector 没问题;若用 aligned_alloc,AVX2 要求 32 字节对齐,AVX-512 要求 64 字节
  • 编译选项必须匹配:Clang 需 -O2 -march=native;GCC 需 -O3 -mavx2 -fopenmp
  • 典型安全用法:std::transform(std::execution::par_unseq, a.begin(), a.end(), b.begin(), [](int x) { return x * x + 1; });
  • 典型崩溃用法:std::for_each(std::execution::par_unseq, v.begin(), v.end(), [&sum](int x) { sum += x; }); —— sum 是共享可变状态,无同步即未定义行为

如何确认并行真的跑起来了?

没有 API 能返回“用了几个线程”,只能靠三类可观测信号交叉验证:

  • CPU 使用率:用 htop -H(Linux)或任务管理器性能页(Windows),观察排序/变换期间是否多个核心持续 >80% 占用
  • 线程 ID 打点(仅调试):std::for_each(std::execution::par, v.begin(), v.end(), [](int&) { std::cout ,输出去重后数量 ≥2 才算分发成功(注意加 <code>std::flush 防缓冲干扰)
  • 人工限核对比:Linux 下 GOMP_THREADS=2 ./a.out,若耗时明显下降(如 120ms → 75ms),说明并行路径已通

最容易被忽略的是:并行策略不解决数据竞争,它只负责分发。你写的 lambda 是否线程安全,完全由你自己保证——std::execution 不加锁、不校验、不兜底。

C++免费学习笔记(深入):立即使用
在学习笔记中,你将探索 C++ 的入门与实战技巧!

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

c++

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
C语言变量命名
C语言变量命名

c语言变量名规则是:1、变量名以英文字母开头;2、变量名中的字母是区分大小写的;3、变量名不能是关键字;4、变量名中不能包含空格、标点符号和类型说明符。php中文网还提供c语言变量的相关下载、相关课程等内容,供大家免费下载使用。

2023.06.20

2909

3

c语言入门自学零基础
c语言入门自学零基础

C语言是当代人学习及生活中的必备基础知识,应用十分广泛,本专题为大家c语言入门自学零基础的相关文章,以及相关课程,感兴趣的朋友千万不要错过了。

2023.07.25

2208

9

c语言运算符的优先级顺序
c语言运算符的优先级顺序

c语言运算符的优先级顺序是括号运算符 > 一元运算符 > 算术运算符 > 移位运算符 > 关系运算符 > 位运算符 > 逻辑运算符 > 赋值运算符 > 逗号运算符。本专题为大家提供c语言运算符相关的各种文章、以及下载和课程。

2023.08.02

1180

5

c语言数据结构
c语言数据结构

数据结构是指将数据按照一定的方式组织和存储的方法。它是计算机科学中的重要概念,用来描述和解决实际问题中的数据组织和处理问题。数据结构可以分为线性结构和非线性结构。线性结构包括数组、链表、堆栈和队列等,而非线性结构包括树和图等。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2023.08.09

1118

4

c语言random函数用法
c语言random函数用法

c语言random函数用法:1、random.random,随机生成(0,1)之间的浮点数;2、random.randint,随机生成在范围之内的整数,两个参数分别表示上限和下限;3、random.randrange,在指定范围内,按指定基数递增的集合中获得一个随机数;4、random.choice,从序列中随机抽选一个数;5、random.shuffle,随机排序。

2023.09.05

1316

5

c语言const用法
c语言const用法

const是关键字,可以用于声明常量、函数参数中的const修饰符、const修饰函数返回值、const修饰指针。详细介绍:1、声明常量,const关键字可用于声明常量,常量的值在程序运行期间不可修改,常量可以是基本数据类型,如整数、浮点数、字符等,也可是自定义的数据类型;2、函数参数中的const修饰符,const关键字可用于函数的参数中,表示该参数在函数内部不可修改等等。

2023.09.20

2038

7

c语言get函数的用法
c语言get函数的用法

get函数是一个用于从输入流中获取字符的函数。可以从键盘、文件或其他输入设备中读取字符,并将其存储在指定的变量中。本文介绍了get函数的用法以及一些相关的注意事项。希望这篇文章能够帮助你更好地理解和使用get函数 。

2023.09.20

3220

8

c数组初始化的方法
c数组初始化的方法

c语言数组初始化的方法有直接赋值法、不完全初始化法、省略数组长度法和二维数组初始化法。详细介绍:1、直接赋值法,这种方法可以直接将数组的值进行初始化;2、不完全初始化法,。这种方法可以在一定程度上节省内存空间;3、省略数组长度法,这种方法可以让编译器自动计算数组的长度;4、二维数组初始化法等等。

2023.09.22

14295

6

c语言中null和NULL的区别
c语言中null和NULL的区别

c语言中null和NULL的区别是:null是C语言中的一个宏定义,通常用来表示一个空指针,可以用于初始化指针变量,或者在条件语句中判断指针是否为空;NULL是C语言中的一个预定义常量,通常用来表示一个空值,用于表示一个空的指针、空的指针数组或者空的结构体指针。

2023.09.22

529

3

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Conan 2 Essentials 免费课程
Conan 2 Essentials 免费课程

共0课时 | 0人学习

CMake 与 Conan 集成实践
CMake 与 Conan 集成实践

共0课时 | 0人学习

Conan 2 高级依赖模型介绍
Conan 2 高级依赖模型介绍

共0课时 | 0人学习