搜索
首页后端开发C++我们如何取消优化蒙特卡洛模拟以暴露英特尔 Sandybridge 管道瓶颈?

How Can We Deoptimize a Monte Carlo Simulation to Expose Intel Sandybridge Pipeline Bottlenecks?

对 Intel Sandybridge 系列 CPU 中的管道进行去优化

此作业的目标是修改给定的程序以使其运行速度较慢,同时保持相同的算法。这是为了更深入地了解英特尔 i7 流水线的运行方式以及指令路径如何重新排序以引入危险。

程序概述

该程序是对欧洲普通看涨期权和看跌期权进行定价的蒙特卡罗模拟。它使用 Box-Muller 算法生成高斯随机数并执行大量模拟来估计期权价格。

恶魔般的无能

目标是故意创建会减慢程序执行速度的不合格代码。以下是一些用“恶魔般的无能”来证明这种方法的合理性的想法:

错误共享

  • 创建由多个线程访问的共享数据结构,但未正确同步。这可能会导致缓存行乒乓球和内存顺序错误推测管道清除。

存储转发停顿

  • 避免使用浮点变量的“-”运算符。相反,将高字节与 0x80 进行异或以翻转符号位,从而导致存储转发停顿。

过多的时间测量

  • 每次迭代的时间具有 CPUID/RDTSC 等繁重操作的主循环,它会序列化指令并停止

不利的数学运算

  • 将常量乘法替换为倒数除法(“为了便于阅读”)。除法较慢且未完全流水线化。

矢量化效率低下

  • 使用 AVX 对乘/平方运算进行向量化,但在调用之前无法使用 vzeroupper标量数学库函数,导致 AVXSSE 转换

数据结构

  • 将 RNG 输出存储在链表或乱序遍历的数组中。对每次迭代的结果执行相同的操作并在最后求和。这引入了指针追逐加载并破坏了缓存局部性。

多线程误用

  • 多线程程序,但强制两个线程共享相同的循环计数器(具有原子增量)来创建错误的共享和争用。这也引入了原子操作不必要的开销。

其他建议

  • 引入不可预测的分支来创建错误预测和管道刷新。
  • 使用恶魔般无能的理由来增加循环携带的依赖链的长度。
  • 引入非连续内存访问模式最大限度地减少缓存利用率。
  • 额外费用学分:编写自己的平方根算法来替换作业中提供的算法。

修改的影响

这些修改预计会显着通过引入管道停顿、缓存未命中和其他性能瓶颈来减慢程序的执行速度。该作业鼓励创造力和愿意探索悲观化代码同时保持原始算法的不同方法的意愿。

以上是我们如何取消优化蒙特卡洛模拟以暴露英特尔 Sandybridge 管道瓶颈?的详细内容。更多信息请关注PHP中文网其他相关文章!

声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
C和XML:在项目中集成数据C和XML:在项目中集成数据May 10, 2025 am 12:18 AM

在C 项目中集成XML可以通过以下步骤实现:1)使用pugixml或TinyXML库解析和生成XML文件,2)选择DOM或SAX方法进行解析,3)处理嵌套节点和多级属性,4)使用调试技巧和最佳实践优化性能。

在C中使用XML:库和工具指南在C中使用XML:库和工具指南May 09, 2025 am 12:16 AM

在C 中使用XML是因为它提供了结构化数据的便捷方式,尤其在配置文件、数据存储和网络通信中不可或缺。1)选择合适的库,如TinyXML、pugixml、RapidXML,根据项目需求决定。2)了解XML解析和生成的两种方式:DOM适合频繁访问和修改,SAX适用于大文件或流数据。3)优化性能时,TinyXML适合小文件,pugixml在内存和速度上表现好,RapidXML处理大文件优异。

C#和C:探索不同的范例C#和C:探索不同的范例May 08, 2025 am 12:06 AM

C#和C 的主要区别在于内存管理、多态性实现和性能优化。1)C#使用垃圾回收器自动管理内存,C 则需要手动管理。2)C#通过接口和虚方法实现多态性,C 使用虚函数和纯虚函数。3)C#的性能优化依赖于结构体和并行编程,C 则通过内联函数和多线程实现。

C XML解析:技术和最佳实践C XML解析:技术和最佳实践May 07, 2025 am 12:06 AM

C 中解析XML数据可以使用DOM和SAX方法。1)DOM解析将XML加载到内存,适合小文件,但可能占用大量内存。2)SAX解析基于事件驱动,适用于大文件,但无法随机访问。选择合适的方法并优化代码可提高效率。

c在特定领域:探索其据点c在特定领域:探索其据点May 06, 2025 am 12:08 AM

C 在游戏开发、嵌入式系统、金融交易和科学计算等领域中的应用广泛,原因在于其高性能和灵活性。1)在游戏开发中,C 用于高效图形渲染和实时计算。2)嵌入式系统中,C 的内存管理和硬件控制能力使其成为首选。3)金融交易领域,C 的高性能满足实时计算需求。4)科学计算中,C 的高效算法实现和数据处理能力得到充分体现。

揭穿神话:C真的是一种死语吗?揭穿神话:C真的是一种死语吗?May 05, 2025 am 12:11 AM

C 没有死,反而在许多关键领域蓬勃发展:1)游戏开发,2)系统编程,3)高性能计算,4)浏览器和网络应用,C 依然是主流选择,展现了其强大的生命力和应用场景。

C#vs. C:编程语言的比较分析C#vs. C:编程语言的比较分析May 04, 2025 am 12:03 AM

C#和C 的主要区别在于语法、内存管理和性能:1)C#语法现代,支持lambda和LINQ,C 保留C特性并支持模板。2)C#自动内存管理,C 需要手动管理。3)C 性能优于C#,但C#性能也在优化中。

用C构建XML应用程序:实例用C构建XML应用程序:实例May 03, 2025 am 12:16 AM

在C 中处理XML数据可以使用TinyXML、Pugixml或libxml2库。1)解析XML文件:使用DOM或SAX方法,DOM适合小文件,SAX适合大文件。2)生成XML文件:将数据结构转换为XML格式并写入文件。通过这些步骤,可以有效地管理和操作XML数据。

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

Video Face Swap

Video Face Swap

使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热门文章

热工具

Dreamweaver Mac版

Dreamweaver Mac版

视觉化网页开发工具

SublimeText3 Mac版

SublimeText3 Mac版

神级代码编辑软件(SublimeText3)

EditPlus 中文破解版

EditPlus 中文破解版

体积小,语法高亮,不支持代码提示功能

MinGW - 适用于 Windows 的极简 GNU

MinGW - 适用于 Windows 的极简 GNU

这个项目正在迁移到osdn.net/projects/mingw的过程中,你可以继续在那里关注我们。MinGW:GNU编译器集合(GCC)的本地Windows移植版本,可自由分发的导入库和用于构建本地Windows应用程序的头文件;包括对MSVC运行时的扩展,以支持C99功能。MinGW的所有软件都可以在64位Windows平台上运行。

SecLists

SecLists

SecLists是最终安全测试人员的伙伴。它是一个包含各种类型列表的集合,这些列表在安全评估过程中经常使用,都在一个地方。SecLists通过方便地提供安全测试人员可能需要的所有列表,帮助提高安全测试的效率和生产力。列表类型包括用户名、密码、URL、模糊测试有效载荷、敏感数据模式、Web shell等等。测试人员只需将此存储库拉到新的测试机上,他就可以访问到所需的每种类型的列表。