cari
Rumahpembangunan bahagian belakangC++Bagaimanakah Kami Boleh Menyahoptimumkan Simulasi Monte Carlo untuk Mendedahkan Bottlenecks Talian Paip Intel Sandybridge?

How Can We Deoptimize a Monte Carlo Simulation to Expose Intel Sandybridge Pipeline Bottlenecks?

Menyahoptimumkan program untuk saluran paip dalam CPU keluarga Intel Sandybridge

Matlamat tugasan ini adalah untuk mengubah suai program yang diberikan untuk menjadikannya berjalan lebih perlahan, sambil mengekalkan algoritma yang sama. Ini adalah untuk mendapatkan pemahaman yang lebih mendalam tentang cara saluran paip Intel i7 beroperasi dan cara laluan arahan boleh disusun semula untuk memperkenalkan bahaya.

Gambaran Keseluruhan Program

Program ini adalah simulasi Monte-Carlo yang menetapkan harga pilihan panggilan dan letak vanila Eropah. Ia menggunakan algoritma Box-Muller untuk menjana nombor rawak Gaussian dan melakukan sejumlah besar simulasi untuk menganggarkan harga pilihan.

Ketidakcekapan Iblis

Objektifnya adalah untuk sengaja cipta kod yang tidak cekap yang akan memperlahankan pelaksanaan program. Berikut ialah beberapa idea yang mewajarkan pendekatan ini dengan "ketidakcekapan diabolik":

Perkongsian Palsu

  • Buat struktur data kongsi yang diakses oleh berbilang urutan, tetapi tidak disegerakkan dengan betul. Ini boleh membawa kepada ping-pong talian cache dan saluran paip salah spekulasi pesanan memori dibersihkan.

Gerai Pemindahan Stor

  • Elakkan menggunakan operator "-" untuk pembolehubah titik terapung. Sebaliknya, XOR bait tinggi dengan 0x80 untuk membalikkan bit tanda, menyebabkan gerai pemajuan stor.

Pengukuran Masa Berlebihan

  • Masakan setiap lelaran gelung utama dengan operasi berat seperti CPUID/RDTSC, yang menyusun arahan dan menghentikannya talian paip.

Operasi Matematik Tidak Menguntungkan

  • Gantikan pendaraban dengan pemalar dengan pembahagian dengan salingannya ("untuk memudahkan pembacaan"). Pembahagian adalah lebih perlahan dan tidak disalurkan sepenuhnya.

Vektorisasi Tidak Cekap

  • Vektorkan operasi darab/sqrt dengan AVX, tetapi gagal menggunakan vzeroupper sebelum membuat panggilan fungsi perpustakaan matematik skalar, menyebabkan peralihan AVXSSE gerai.

Struktur Data

  • Simpan output RNG dalam senarai terpaut atau dalam tatasusunan yang dilalui di luar susunan. Lakukan perkara yang sama untuk hasil setiap lelaran dan jumlah pada akhir. Ini memperkenalkan beban mengejar penuding dan mengalahkan lokaliti cache.

Salah Guna Berbilang Benang

  • Berbilang benang program tetapi memaksa kedua-dua utas untuk berkongsi pembilang gelung yang sama (dengan kenaikan atom) untuk mencipta perkongsian dan perbalahan palsu. Ini juga memperkenalkan overhed yang tidak perlu daripada operasi atom.

Cadangan Lain

  • Perkenalkan cawangan yang tidak dapat diramalkan untuk mencipta salah ramal dan aliran paip.
  • Gunakan justifikasi yang tidak cekap secara jahat untuk meningkatkan panjang rantai pergantungan yang dibawa gelung.
  • Perkenalkan corak akses memori yang tidak bersebelahan untuk meminimumkan cache penggunaan.
  • Untuk kredit tambahan: Tulis algoritma punca kuasa dua anda sendiri untuk menggantikan algoritma yang disediakan dalam tugasan.

Kesan Pengubahsuaian

Pengubahsuaian ini dijangka akan memperlahankan pelaksanaan program dengan ketara dengan memperkenalkan saluran paip gerai, cache miss dan kesesakan prestasi lain. Tugasan menggalakkan kreativiti dan kesediaan untuk meneroka kaedah yang berbeza untuk mengasingkan kod sambil mengekalkan algoritma asal.

Atas ialah kandungan terperinci Bagaimanakah Kami Boleh Menyahoptimumkan Simulasi Monte Carlo untuk Mendedahkan Bottlenecks Talian Paip Intel Sandybridge?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan
Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn
Bagaimana Perpustakaan Templat St Standard (STL) berfungsi?Bagaimana Perpustakaan Templat St Standard (STL) berfungsi?Mar 12, 2025 pm 04:50 PM

Artikel ini menerangkan Perpustakaan Templat St Standard (STL), yang memberi tumpuan kepada komponen terasnya: bekas, iterator, algoritma, dan functors. Ia memperincikan bagaimana ini berinteraksi untuk membolehkan pengaturcaraan generik, meningkatkan kecekapan kod dan kebolehbacaan t

Bagaimanakah saya menggunakan algoritma dari STL (jenis, mencari, mengubah, dll) dengan cekap?Bagaimanakah saya menggunakan algoritma dari STL (jenis, mencari, mengubah, dll) dengan cekap?Mar 12, 2025 pm 04:52 PM

Artikel ini memperincikan penggunaan algoritma STL yang cekap dalam c. Ia menekankan pilihan struktur data (vektor vs senarai), analisis kerumitan algoritma (mis., Std :: Sort vs Std :: partial_sort), penggunaan iterator, dan pelaksanaan selari. Perangkap biasa seperti

Bagaimana saya mengendalikan pengecualian dengan berkesan di C?Bagaimana saya mengendalikan pengecualian dengan berkesan di C?Mar 12, 2025 pm 04:56 PM

Artikel ini butiran pengendalian pengecualian yang berkesan di C, meliputi percubaan, menangkap, dan membuang mekanik. Ia menekankan amalan terbaik seperti RAII, mengelakkan blok tangkapan yang tidak perlu, dan pengecualian pembalakan untuk kod yang mantap. Artikel ini juga menangani perf

Bagaimanakah saya menggunakan semantik bergerak di C untuk meningkatkan prestasi?Bagaimanakah saya menggunakan semantik bergerak di C untuk meningkatkan prestasi?Mar 18, 2025 pm 03:27 PM

Artikel ini membincangkan menggunakan semantik Move dalam C untuk meningkatkan prestasi dengan mengelakkan penyalinan yang tidak perlu. Ia meliputi pelaksanaan pembina bergerak dan pengendali tugasan, menggunakan STD :: bergerak, dan mengenal pasti senario utama dan perangkap untuk Appl yang berkesan

Bagaimanakah saya menggunakan julat dalam C 20 untuk manipulasi data yang lebih ekspresif?Bagaimanakah saya menggunakan julat dalam C 20 untuk manipulasi data yang lebih ekspresif?Mar 17, 2025 pm 12:58 PM

C 20 julat meningkatkan manipulasi data dengan ekspresi, komposiliti, dan kecekapan. Mereka memudahkan transformasi kompleks dan mengintegrasikan ke dalam kod sedia ada untuk prestasi dan kebolehkerjaan yang lebih baik.

Bagaimanakah penghantaran dinamik berfungsi di C dan bagaimana ia mempengaruhi prestasi?Bagaimanakah penghantaran dinamik berfungsi di C dan bagaimana ia mempengaruhi prestasi?Mar 17, 2025 pm 01:08 PM

Artikel ini membincangkan penghantaran dinamik dalam C, kos prestasinya, dan strategi pengoptimuman. Ia menyoroti senario di mana penghantaran dinamik memberi kesan kepada prestasi dan membandingkannya dengan penghantaran statik, menekankan perdagangan antara prestasi dan

Bagaimanakah saya menggunakan rujukan RValue dengan berkesan di C?Bagaimanakah saya menggunakan rujukan RValue dengan berkesan di C?Mar 18, 2025 pm 03:29 PM

Artikel membincangkan penggunaan rujukan RValue yang berkesan dalam C untuk bergerak semantik, pemajuan sempurna, dan pengurusan sumber, menonjolkan amalan terbaik dan penambahbaikan prestasi. (159 aksara)

Bagaimanakah pengurusan memori C berfungsi, termasuk petunjuk baru, memadam, dan pintar?Bagaimanakah pengurusan memori C berfungsi, termasuk petunjuk baru, memadam, dan pintar?Mar 17, 2025 pm 01:04 PM

Pengurusan memori C menggunakan petunjuk baru, memadam, dan pintar. Artikel ini membincangkan manual vs pengurusan automatik dan bagaimana penunjuk pintar menghalang kebocoran memori.

See all articles

Alat AI Hot

Undresser.AI Undress

Undresser.AI Undress

Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover

AI Clothes Remover

Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool

Undress AI Tool

Gambar buka pakaian secara percuma

Clothoff.io

Clothoff.io

Penyingkiran pakaian AI

AI Hentai Generator

AI Hentai Generator

Menjana ai hentai secara percuma.

Artikel Panas

R.E.P.O. Kristal tenaga dijelaskan dan apa yang mereka lakukan (kristal kuning)
3 minggu yang laluBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Tetapan grafik terbaik
3 minggu yang laluBy尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. Cara Memperbaiki Audio Jika anda tidak dapat mendengar sesiapa
3 minggu yang laluBy尊渡假赌尊渡假赌尊渡假赌

Alat panas

SublimeText3 versi Mac

SublimeText3 versi Mac

Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

PhpStorm versi Mac

PhpStorm versi Mac

Alat pembangunan bersepadu PHP profesional terkini (2018.2.1).

Versi Mac WebStorm

Versi Mac WebStorm

Alat pembangunan JavaScript yang berguna

ZendStudio 13.5.1 Mac

ZendStudio 13.5.1 Mac

Persekitaran pembangunan bersepadu PHP yang berkuasa

MinGW - GNU Minimalis untuk Windows

MinGW - GNU Minimalis untuk Windows

Projek ini dalam proses untuk dipindahkan ke osdn.net/projects/mingw, anda boleh terus mengikuti kami di sana. MinGW: Port Windows asli bagi GNU Compiler Collection (GCC), perpustakaan import yang boleh diedarkan secara bebas dan fail pengepala untuk membina aplikasi Windows asli termasuk sambungan kepada masa jalan MSVC untuk menyokong fungsi C99. Semua perisian MinGW boleh dijalankan pada platform Windows 64-bit.