Rumah >pembangunan bahagian belakang >Tutorial Python >Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!
Helo semua, saya seorang pemula! Hari ini saya ingin berkongsi dengan anda program Python yang sangat praktikal.
Ramai rakan sama ada di sekolah atau di tempat kerja akan menghadapi masalah iaitu mengeluarkan teks daripada PPT dan menyimpannya ke Word Antaranya , ini boleh memudahkan anda membaca atau mencetak teks. Tetapi banyak kali, rakan hanya boleh mengekstrak teks dalam PPT satu persatu dengan menyalin dan menampal. Kaedah pengendalian ini sudah pasti sangat tidak cekap Hari ini, Rookie Brother akan membawakan anda kaedah baharu, menggunakan program untuk mengekstrak teks daripada PPT secara berkelompok dan menyimpannya pada dokumen perkataan.
1. Adegan yang sesuaiSebagai contoh, saya mempunyai kandungan PPT sedemikian, yang mengandungi banyak teks dan gambar Saya lebih berminat dengan teks, terutamanya dalam kertas atau ppt beberapa laporan akademik yang penting, di mana banyak teks perlu diekstrak dan dianalisis. Di bawah saya berikan contoh halaman PPT yang mudah:
Seperti yang anda lihat, PPT di atas mengandungi beberapa maklumat kandungan teks dan gambar, tetapi saya hanya mahu mengekstrak teks. Sebenarnya, ini boleh dilakukan dengan mudah dengan Python Lihat kesan akhir:
Kesannya bukan. buruk, ia sebenarnya sangat mudah Ya, mari kita lihat bagaimana untuk melakukannya.
2. Reka bentuk programKami terutamanya menggunakan pustaka python-pptx dan perpustakaan python-docx. Digunakan untuk memproses fail PPT dan fail perkataan masing-masing. Ia boleh dipasang terus dengan pip3 Keseluruhan program ini sangat pendek dan ringkas Kod teras hanya memerlukan enam baris Program adalah seperti yang ditunjukkan di bawah:
.Kod ini sebenarnya sangat pendek untuk membolehkan semua orang memahami program ini dengan lebih baik, anda boleh menerangkannya satu persatu dengan gambar berikut.
Dalam atur cara, kami menggunakan sejumlah 3 peringkat gelung untuk memproses:
1). Tahap pertama untuk gelung digunakan untuk melayari slaid setiap halaman; ) .Dalam gelung kedua, tentukan setiap bentuk dalam slaid, dan kemudian tentukan sama ada halaman itu mengandungi kotak teks. Jika terdapat kotak teks, dapatkan kotak teks dan namakannya text_frame.
3). Gelung ketiga untuk merentasi semua kandungan perenggan dalam kotak teks, mengekstrak teks dan menyimpannya ke perkataan antara .
Selepas melintasi keseluruhan fail PPT, simpan semua maklumat teks yang diekstrak ke dokumen perkataan tempatan. Kesannya adalah seperti yang ditunjukkan di bawah:
Fail PPT di atas mengandungi empat slaid dengan teks. Selepas menjalankan program, hasil pengekstrakan teks ditunjukkan dalam rajah di bawah.
Di atas ialah perkongsian kes automasi yang dibawakan oleh Rookie kepada anda hari ini Dengan hanya beberapa baris kod, kerja semua orang boleh dipertingkatkan dengan baik. Kecekapan, semua orang juga harus menggunakan program untuk pengekstrakan cepat.
Atas ialah kandungan terperinci Mengekstrak teks PPT dan memindahkannya ke Word menjadi mudah, hanya memerlukan 20 baris kod Python!. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!