


Menyahoptimumkan program untuk saluran paip dalam CPU keluarga Intel Sandybridge
Matlamat tugasan ini adalah untuk mengubah suai program yang diberikan untuk menjadikannya berjalan lebih perlahan, sambil mengekalkan algoritma yang sama. Ini adalah untuk mendapatkan pemahaman yang lebih mendalam tentang cara saluran paip Intel i7 beroperasi dan cara laluan arahan boleh disusun semula untuk memperkenalkan bahaya.
Gambaran Keseluruhan Program
Program ini adalah simulasi Monte-Carlo yang menetapkan harga pilihan panggilan dan letak vanila Eropah. Ia menggunakan algoritma Box-Muller untuk menjana nombor rawak Gaussian dan melakukan sejumlah besar simulasi untuk menganggarkan harga pilihan.
Ketidakcekapan Iblis
Objektifnya adalah untuk sengaja cipta kod yang tidak cekap yang akan memperlahankan pelaksanaan program. Berikut ialah beberapa idea yang mewajarkan pendekatan ini dengan "ketidakcekapan diabolik":
Perkongsian Palsu
- Buat struktur data kongsi yang diakses oleh berbilang urutan, tetapi tidak disegerakkan dengan betul. Ini boleh membawa kepada ping-pong talian cache dan saluran paip salah spekulasi pesanan memori dibersihkan.
Gerai Pemindahan Stor
- Elakkan menggunakan operator "-" untuk pembolehubah titik terapung. Sebaliknya, XOR bait tinggi dengan 0x80 untuk membalikkan bit tanda, menyebabkan gerai pemajuan stor.
Pengukuran Masa Berlebihan
- Masakan setiap lelaran gelung utama dengan operasi berat seperti CPUID/RDTSC, yang menyusun arahan dan menghentikannya talian paip.
Operasi Matematik Tidak Menguntungkan
- Gantikan pendaraban dengan pemalar dengan pembahagian dengan salingannya ("untuk memudahkan pembacaan"). Pembahagian adalah lebih perlahan dan tidak disalurkan sepenuhnya.
Vektorisasi Tidak Cekap
- Vektorkan operasi darab/sqrt dengan AVX, tetapi gagal menggunakan vzeroupper sebelum membuat panggilan fungsi perpustakaan matematik skalar, menyebabkan peralihan AVXSSE gerai.
Struktur Data
- Simpan output RNG dalam senarai terpaut atau dalam tatasusunan yang dilalui di luar susunan. Lakukan perkara yang sama untuk hasil setiap lelaran dan jumlah pada akhir. Ini memperkenalkan beban mengejar penuding dan mengalahkan lokaliti cache.
Salah Guna Berbilang Benang
- Berbilang benang program tetapi memaksa kedua-dua utas untuk berkongsi pembilang gelung yang sama (dengan kenaikan atom) untuk mencipta perkongsian dan perbalahan palsu. Ini juga memperkenalkan overhed yang tidak perlu daripada operasi atom.
Cadangan Lain
- Perkenalkan cawangan yang tidak dapat diramalkan untuk mencipta salah ramal dan aliran paip.
- Gunakan justifikasi yang tidak cekap secara jahat untuk meningkatkan panjang rantai pergantungan yang dibawa gelung.
- Perkenalkan corak akses memori yang tidak bersebelahan untuk meminimumkan cache penggunaan.
- Untuk kredit tambahan: Tulis algoritma punca kuasa dua anda sendiri untuk menggantikan algoritma yang disediakan dalam tugasan.
Kesan Pengubahsuaian
Pengubahsuaian ini dijangka akan memperlahankan pelaksanaan program dengan ketara dengan memperkenalkan saluran paip gerai, cache miss dan kesesakan prestasi lain. Tugasan menggalakkan kreativiti dan kesediaan untuk meneroka kaedah yang berbeza untuk mengasingkan kod sambil mengekalkan algoritma asal.
Atas ialah kandungan terperinci Bagaimanakah Kami Boleh Menyahoptimumkan Simulasi Monte Carlo untuk Mendedahkan Bottlenecks Talian Paip Intel Sandybridge?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

GULC adalah perpustakaan C berprestasi tinggi yang mengutamakan overhead yang minimum, inlining agresif, dan pengoptimuman pengkompil. Sesuai untuk aplikasi kritikal prestasi seperti perdagangan frekuensi tinggi dan sistem tertanam, reka bentuknya menekankan kesederhanaan, modul

Butiran artikel ini C jenis pulangan fungsi, merangkumi asas (int, float, char, dan lain -lain), diperolehi (tatasusunan, petunjuk, struktur), dan jenis kekosongan. Pengkompil menentukan jenis pulangan melalui pengisytiharan fungsi dan pernyataan pulangan, menguatkuasakan

Artikel ini menerangkan perisytiharan fungsi C vs definisi, argumen lulus (dengan nilai dan penunjuk), nilai pulangan, dan perangkap umum seperti kebocoran memori dan jenis ketidakcocokan. Ia menekankan pentingnya pengisytiharan modularity dan provi

Butiran artikel ini C berfungsi untuk penukaran kes rentetan. Ia menerangkan menggunakan ToUpper () dan Tolower () dari CType.H, meleleh melalui rentetan, dan mengendalikan terminator null. Perangkap biasa seperti melupakan ctype.h dan mengubahsuai literal rentetan adalah

Artikel ini mengkaji fungsi penyimpanan nilai pulangan C. Nilai pulangan kecil biasanya disimpan dalam daftar untuk kelajuan; Nilai yang lebih besar boleh menggunakan petunjuk untuk memori (timbunan atau timbunan), memberi kesan kepada seumur hidup dan memerlukan pengurusan memori manual. Secara langsung acc

Artikel ini menganalisis kegunaan pelbagai kata sifat "berbeza," meneroka fungsi tatabahasa, frasa umum (mis., "Berbeza," "berbeza"), dan aplikasi bernuansa dalam formal vs tidak formal

Artikel ini menerangkan Perpustakaan Templat St Standard (STL), yang memberi tumpuan kepada komponen terasnya: bekas, iterator, algoritma, dan functors. Ia memperincikan bagaimana ini berinteraksi untuk membolehkan pengaturcaraan generik, meningkatkan kecekapan kod dan kebolehbacaan t

Artikel ini memperincikan penggunaan algoritma STL yang cekap dalam c. Ia menekankan pilihan struktur data (vektor vs senarai), analisis kerumitan algoritma (mis., Std :: Sort vs Std :: partial_sort), penggunaan iterator, dan pelaksanaan selari. Perangkap biasa seperti


Alat AI Hot

Undresser.AI Undress
Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover
Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool
Gambar buka pakaian secara percuma

Clothoff.io
Penyingkiran pakaian AI

AI Hentai Generator
Menjana ai hentai secara percuma.

Artikel Panas

Alat panas

Dreamweaver Mac版
Alat pembangunan web visual

SublimeText3 Linux versi baharu
SublimeText3 Linux versi terkini

SublimeText3 versi Cina
Versi Cina, sangat mudah digunakan

SublimeText3 versi Inggeris
Disyorkan: Versi Win, menyokong gesaan kod!

ZendStudio 13.5.1 Mac
Persekitaran pembangunan bersepadu PHP yang berkuasa
