C++实现高性能循环缓冲区 _ 避免数据拷贝的读写逻辑【源码】

小丽大大_6132

小丽大大_6132

2026-04-13

909人浏览

原创

std::vector和std::deque不适合高性能循环缓冲区,因其内存不连续、易触发重分配与隐式拷贝,且缺乏零拷贝读写视图;需固定大小连续内存、双原子偏移及位运算索引。

c++实现高性能循环缓冲区 _ 避免数据拷贝的读写逻辑【源码】

为什么 std::vector 或 std::deque 不适合做高性能循环缓冲区

因为它们默认不保证内存连续(std::deque 是分段连续)、读写时容易触发隐式拷贝或重分配,且缺乏原子性的“零拷贝”读写视图。高性能场景下,你真正需要的是:一段固定大小的连续内存 + 两个独立移动的读/写偏移 + 无需 memcpy 就能拿到数据起始地址的能力。

常见错误是用 std::vector<uint8_t></uint8_t> 手动维护 read_pos/write_pos,但每次 read() 都调用 std::copy —— 这本质还是拷贝,没解决问题。

  • 真正零拷贝读写,必须返回 uint8_t* 指针和长度,由上层决定是否 memcpy
  • 缓冲区大小必须是 2 的幂(如 4096),才能用位运算代替取模,避免分支和除法开销
  • 多线程读写需额外同步,但单生产者单消费者(SPSC)场景下,可仅靠内存序 + 原子偏移实现无锁

RingBuffer::write_prepare() 和 write_commit() 分离设计的原因

这是避免数据拷贝的核心机制:不把写入封装成“一次调用完成”,而是拆成「申请可用空间指针」+「通知实际写入了多少」两步。这样上层可直接用 memcpy、DMA 写入、甚至 vectorized load/store 到返回的内存区域。

典型误用是合并成一个函数,比如 write(const void*, size_t) —— 它必然内部 memcpy,丧失零拷贝意义。

  • write_prepare() 返回 uint8_t* 起始地址和可写长度 size_t,不修改 write_pos
  • write_commit(size_t len) 只更新 write_pos,不碰内存
  • 两者之间允许中断、分批写入、甚至跨函数边界(例如先 prepare,进中断处理,再 commit)

如何正确处理跨边界读写(wrap-around)而不引入分支

关键在利用 2 的幂大小 + 位掩码。假设缓冲区大小为 CAPACITY = 4096,则用 mask = CAPACITY - 1 替代 % CAPACITY。所有索引运算都用 & mask,CPU 流水线友好,无跳转预测失败开销。

C++ 算法竞赛自动化测试数据生成与校验框架
C++ 算法竞赛自动化测试数据生成与校验框架

根据原题生成新题面、验证器及完整测试数据,自动套用 testlib 模板,用于用户要求生成测试数据时。

下载

但跨边界访问不能靠单指针解决:当 read_pos + len > CAPACITY,实际数据分布在尾部 + 头部两段。所以 read_peek() 必须返回两个片段:{ptr1, len1} 和 {ptr2, len2}(后者可能为 0)。

  • 返回双片段结构体比抛异常或返回 nullptr 更高效,避免动态分配或错误处理分支
  • 上层逻辑需主动检查 len2 > 0,决定是否 memcpy 两次(或用 memmove 合并)
  • 不要尝试用 mmap(MAP_ANONYMOUS) 拼接物理页来“消除 wrap-around”——这会破坏缓存局部性,且不可移植

SPSC 场景下用 std::atomic<size_t></size_t> 但不用锁的注意事项

SPSC 是唯一能安全省掉互斥锁的常见模式。但仅靠 std::atomic<size_t></size_t> 不够,必须配合正确的内存序和读写顺序约束。

典型坑是写端 write_commit() 用 store(relaxed),但读端未对写入内存做 load(acquire) —— 编译器或 CPU 可能重排指令,导致读到未写完的数据。

  • 写端 write_commit() 应用 store(std::memory_order_release)
  • 读端 read_peek() 开头对 write_pos 的 load(std::memory_order_acquire) 是必须的
  • 读端 read_commit() 更新 read_pos 也需 store(std::memory_order_release)
  • 别依赖 std::atomic_thread_fence 替代原子操作的内存序 —— 它更难验证,且现代编译器对原子操作优化更好

跨平台兼容性上,x86-64 的 acquire/release 几乎无额外指令开销,但 ARM64 需 ldar/stlr,仍远轻于 mutex。

C++免费学习笔记(深入):立即使用
在学习笔记中,你将探索 C++ 的入门与实战技巧!

相关文章

数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

相关标签:

c++

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
c语言const用法
c语言const用法

const是关键字,可以用于声明常量、函数参数中的const修饰符、const修饰函数返回值、const修饰指针。详细介绍:1、声明常量,const关键字可用于声明常量,常量的值在程序运行期间不可修改,常量可以是基本数据类型,如整数、浮点数、字符等,也可是自定义的数据类型;2、函数参数中的const修饰符,const关键字可用于函数的参数中,表示该参数在函数内部不可修改等等。

2023.09.20

1938

7

golang结构体相关大全
golang结构体相关大全

本专题整合了golang结构体相关大全,想了解更多内容,请阅读专题下面的文章。

2025.06.09

4014

18

golang结构体方法
golang结构体方法

本专题整合了golang结构体相关内容,请阅读专题下面的文章了解更多。

2025.07.04

4171

25

javascriptvoid(o)怎么解决
javascriptvoid(o)怎么解决

javascriptvoid(o)的解决办法:1、检查语法错误;2、确保正确的执行环境;3、检查其他代码的冲突;4、使用事件委托;5、使用其他绑定方式;6、检查外部资源等等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2023.11.23

616

5

java中void的含义
java中void的含义

本专题整合了Java中void的相关内容,阅读专题下面的文章了解更多详细内容。

2025.11.27

351

13

C++ 智能指针与现代内存管理
C++ 智能指针与现代内存管理

深入讲解 C++ 现代内存管理的核心工具——智能指针,涵盖 unique_ptr 独占所有权语义、shared_ptr 引用计数机制与循环引用问题、weak_ptr 弱引用的应用场景、make_unique/make_shared 工厂函数的性能优势、自定义删除器的编写、RAII 资源管理思想的实践,以及从裸指针迁移到智能指针的重构策略,帮助开发者编写安全无泄漏的现代 C++ 代码。

2026.04.23

299

31

线程和进程的区别
线程和进程的区别

线程和进程的区别:线程是进程的一部分,用于实现并发和并行操作,而线程共享进程的资源,通信更方便快捷,切换开销较小。本专题为大家提供线程和进程区别相关的各种文章、以及下载和课程。

2023.08.10

3558

6

Python 多线程与异步编程实战
Python 多线程与异步编程实战

本专题系统讲解 Python 多线程与异步编程的核心概念与实战技巧,包括 threading 模块基础、线程同步机制、GIL 原理、asyncio 异步任务管理、协程与事件循环、任务调度与异常处理。通过实战示例,帮助学习者掌握 如何构建高性能、多任务并发的 Python 应用。

2025.12.24

1029

20

java多线程相关教程合集
java多线程相关教程合集

本专题整合了java多线程相关教程,阅读专题下面的文章了解更多详细内容。

2026.01.21

343

30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Conan 2 Essentials 免费课程
Conan 2 Essentials 免费课程

共0课时 | 0人学习

CMake 与 Conan 集成实践
CMake 与 Conan 集成实践

共0课时 | 0人学习

Conan 2 高级依赖模型介绍
Conan 2 高级依赖模型介绍

共0课时 | 0人学习