cari
Rumahpembangunan bahagian belakangTutorial PythonMengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

Helo semua, saya seorang pemula! Hari ini saya ingin berkongsi dengan anda program Python yang sangat praktikal.

Kekeliruan Ditemui

Ramai rakan sama ada di sekolah atau di tempat kerja akan menghadapi masalah iaitu mengeluarkan teks daripada PPT dan menyimpannya ke Word Antaranya , ini boleh memudahkan anda membaca atau mencetak teks. Tetapi banyak kali, rakan hanya boleh mengekstrak teks dalam PPT satu persatu dengan menyalin dan menampal. Kaedah pengendalian ini sudah pasti sangat tidak cekap Hari ini, Rookie Brother akan membawakan anda kaedah baharu, menggunakan program untuk mengekstrak teks daripada PPT secara berkelompok dan menyimpannya pada dokumen perkataan.

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

1. Adegan yang sesuai

Sebagai contoh, saya mempunyai kandungan PPT sedemikian, yang mengandungi banyak teks dan gambar Saya lebih berminat dengan teks, terutamanya dalam kertas atau ppt beberapa laporan akademik yang penting, di mana banyak teks perlu diekstrak dan dianalisis. Di bawah saya berikan contoh halaman PPT yang mudah:

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

Seperti yang anda lihat, PPT di atas mengandungi beberapa maklumat kandungan teks dan gambar, tetapi saya hanya mahu mengekstrak teks. Sebenarnya, ini boleh dilakukan dengan mudah dengan Python Lihat kesan akhir:

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

Kesannya bukan. buruk, ia sebenarnya sangat mudah Ya, mari kita lihat bagaimana untuk melakukannya.

2. Reka bentuk program

Kami terutamanya menggunakan pustaka python-pptx dan perpustakaan python-docx. Digunakan untuk memproses fail PPT dan fail perkataan masing-masing. Ia boleh dipasang terus dengan pip3 Keseluruhan program ini sangat pendek dan ringkas Kod teras hanya memerlukan enam baris Program adalah seperti yang ditunjukkan di bawah:

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

.


Kod ini sebenarnya sangat pendek untuk membolehkan semua orang memahami program ini dengan lebih baik, anda boleh menerangkannya satu persatu dengan gambar berikut.

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

Dalam atur cara, kami menggunakan sejumlah 3 peringkat gelung untuk memproses:

1). Tahap pertama untuk gelung digunakan untuk melayari slaid setiap halaman; ) .Dalam gelung kedua, tentukan setiap bentuk dalam slaid, dan kemudian tentukan sama ada halaman itu mengandungi kotak teks. Jika terdapat kotak teks, dapatkan kotak teks dan namakannya text_frame.

3). Gelung ketiga untuk merentasi semua kandungan perenggan dalam kotak teks, mengekstrak teks dan menyimpannya ke perkataan antara .

Selepas melintasi keseluruhan fail PPT, simpan semua maklumat teks yang diekstrak ke dokumen perkataan tempatan. Kesannya adalah seperti yang ditunjukkan di bawah:

Fail PPT di atas mengandungi empat slaid dengan teks. Selepas menjalankan program, hasil pengekstrakan teks ditunjukkan dalam rajah di bawah.

Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!

Di atas ialah perkongsian kes automasi yang dibawakan oleh Rookie kepada anda hari ini Dengan hanya beberapa baris kod, kerja semua orang boleh dipertingkatkan dengan baik. Kecekapan, semua orang juga harus menggunakan program untuk pengekstrakan cepat.

Atas ialah kandungan terperinci Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan
Artikel ini dikembalikan pada:51CTO.COM. Jika ada pelanggaran, sila hubungi admin@php.cn Padam
Bagaimanakah pilihan antara senarai dan tatasusunan memberi kesan kepada prestasi keseluruhan aplikasi Python yang berurusan dengan dataset yang besar?Bagaimanakah pilihan antara senarai dan tatasusunan memberi kesan kepada prestasi keseluruhan aplikasi Python yang berurusan dengan dataset yang besar?May 03, 2025 am 12:11 AM

Forhandlinglargedatasetsinpython, usenumpyarraysforbetterperformance.1) numpyarraysarememory-efisien danfasterfornumumerical.2) mengelakkan yang tidak dapat dipertahankan.3)

Jelaskan bagaimana memori diperuntukkan untuk senarai berbanding tatasusunan dalam Python.Jelaskan bagaimana memori diperuntukkan untuk senarai berbanding tatasusunan dalam Python.May 03, 2025 am 12:10 AM

Inpython, listsusedynamicMemoryAllocationwithover-peruntukan, pemecahan yang tidak dapat dilaksanakan.1) listsallocatemoremoremorythanneedinitial, resizingwhennessary.2) numpyarraysallocateExactMemoreForelements, menawarkanpredictableSabeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeBeat.

Bagaimana anda menentukan jenis data elemen dalam array python?Bagaimana anda menentukan jenis data elemen dalam array python?May 03, 2025 am 12:06 AM

Inpython, YouCansspectHedatypeyFeleMeremodelerernspant.1) Usenpynernrump.1) usenpynerp.dloatp.ploatm64, formor preciscontrolatatypes.

Apa itu Numpy, dan mengapa penting untuk pengkomputeran berangka dalam Python?Apa itu Numpy, dan mengapa penting untuk pengkomputeran berangka dalam Python?May 03, 2025 am 12:03 AM

Numpyisessentialfornumericalcomputinginpythonduetoitsspeed, ingatanefisiensi, dancomprehensivemathematicalfunctions.1) it'sfastbeCauseitperformsoperatiation

Bincangkan konsep 'peruntukan memori bersebelahan' dan kepentingannya untuk tatasusunan.Bincangkan konsep 'peruntukan memori bersebelahan' dan kepentingannya untuk tatasusunan.May 03, 2025 am 12:01 AM

Contiguousmemoryallocationiscialforarraysbecauseitallowsficientandfastelementaccess.1) itenablesconstantTimeAccess, O (1), duetodirectaddresscalculation.2) itimproveScheFiCiencyBymultmulteLemiSphetfespercacheline.3)

Bagaimana anda memotong senarai python?Bagaimana anda memotong senarai python?May 02, 2025 am 12:14 AM

Slicingapythonlistisdoneusingthesyntaxlist [Mula: berhenti: langkah] .here'showitworks: 1) startistheindexofthefirstelementtoinclude.2) stopistheindexofthefirstelementToexclude.3)

Apakah beberapa operasi biasa yang boleh dilakukan pada array numpy?Apakah beberapa operasi biasa yang boleh dilakukan pada array numpy?May 02, 2025 am 12:09 AM

NumpyallowsforvariousoperationsonArrays: 1) BasicarithmeticLikeaddition, penolakan, pendaraban, danDivision; 2) Pengerjaan AdvancedSuchasmatrixmultiplication; 3) Element-WiseOperationswithoutExplicitLoops;

Bagaimana tatasusunan digunakan dalam analisis data dengan python?Bagaimana tatasusunan digunakan dalam analisis data dengan python?May 02, 2025 am 12:09 AM

Arraysinpython, terutamanya yang ada, adalah, penawaran yang ditawarkan.1) numpyarraysenableFandlingoflargedataSetsandClexPleperationsLikemovingAverages.2)

See all articles

Alat AI Hot

Undresser.AI Undress

Undresser.AI Undress

Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover

AI Clothes Remover

Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool

Undress AI Tool

Gambar buka pakaian secara percuma

Clothoff.io

Clothoff.io

Penyingkiran pakaian AI

Video Face Swap

Video Face Swap

Tukar muka dalam mana-mana video dengan mudah menggunakan alat tukar muka AI percuma kami!

Alat panas

SublimeText3 versi Cina

SublimeText3 versi Cina

Versi Cina, sangat mudah digunakan

MantisBT

MantisBT

Mantis ialah alat pengesan kecacatan berasaskan web yang mudah digunakan yang direka untuk membantu dalam pengesanan kecacatan produk. Ia memerlukan PHP, MySQL dan pelayan web. Lihat perkhidmatan demo dan pengehosan kami.

MinGW - GNU Minimalis untuk Windows

MinGW - GNU Minimalis untuk Windows

Projek ini dalam proses untuk dipindahkan ke osdn.net/projects/mingw, anda boleh terus mengikuti kami di sana. MinGW: Port Windows asli bagi GNU Compiler Collection (GCC), perpustakaan import yang boleh diedarkan secara bebas dan fail pengepala untuk membina aplikasi Windows asli termasuk sambungan kepada masa jalan MSVC untuk menyokong fungsi C99. Semua perisian MinGW boleh dijalankan pada platform Windows 64-bit.

mPDF

mPDF

mPDF ialah perpustakaan PHP yang boleh menjana fail PDF daripada HTML yang dikodkan UTF-8. Pengarang asal, Ian Back, menulis mPDF untuk mengeluarkan fail PDF "dengan cepat" dari tapak webnya dan mengendalikan bahasa yang berbeza. Ia lebih perlahan dan menghasilkan fail yang lebih besar apabila menggunakan fon Unicode daripada skrip asal seperti HTML2FPDF, tetapi menyokong gaya CSS dsb. dan mempunyai banyak peningkatan. Menyokong hampir semua bahasa, termasuk RTL (Arab dan Ibrani) dan CJK (Cina, Jepun dan Korea). Menyokong elemen peringkat blok bersarang (seperti P, DIV),

Muat turun versi mac editor Atom

Muat turun versi mac editor Atom

Editor sumber terbuka yang paling popular