


Pisah Rentetan kepada Perkataan dengan Pembatas Sempadan Berbilang Kata
Apabila bekerja dengan data teks, selalunya perlu untuk membahagikan teks kepada perkataan individu . Walau bagaimanapun, pemisahan rentetan menggunakan pembatas boleh menjadi mencabar apabila bekerja dengan teks yang merangkumi pelbagai pembatas yang berpotensi, seperti koma, noktah dan sempang.
Python's str.split() Had
Kaedah str.split() terbina dalam Python biasanya digunakan untuk membelah rentetan. Walau bagaimanapun, ia hanya menerima satu pembatas sebagai hujah. Dalam contoh yang disediakan, kod berikut akan membahagikan ayat pada ruang kosong tetapi meninggalkan tanda baca di tempatnya:
text = "Hey, you - what are you doing here!?" words = text.split() ['hey', 'you - what', 'are', 'you', 'doing', 'here!?']
Penyelesaian: Ungkapan Biasa dengan re.split()
Untuk memisahkan rentetan dengan berkesan berbilang pembatas, ungkapan biasa dan kaedah re.split() boleh digunakan. re.split() menerima corak sebagai hujah dan membelah rentetan berdasarkan semua kemunculan corak itu.
Kunci untuk membelah perkataan dengan berbilang pembatas adalah untuk menentukan corak yang sepadan dengan mana-mana pembatas yang berpotensi. Corak berikut, 'W ', sepadan dengan mana-mana aksara bukan perkataan:
import re text = "Hey, you - what are you doing here!?" words = re.split('\W+', text) print(words)
Ini akan menghasilkan output yang diingini:
['hey', 'you', 'what', 'are', 'you', 'doing', 'here']
Menangkap Kumpulan
Jika mahu, menangkap kumpulan boleh digunakan untuk mengekstrak bukan sahaja perkataan tetapi juga pembatas. Sebagai contoh, corak berikut termasuk kumpulan penangkapan dalam kurungan, yang akan menangkap sebarang aksara bukan perkataan:
text = "Hey, you - what are you doing here!?" words = re.split('(\W+)', text) print(words)
Ini akan menghasilkan senarai yang merangkumi kedua-dua perkataan dan pembatas:
['Hey', ', ', 'you', ' - ', 'what', ' ', 'are', ' ', 'you', ' ', 'doing', ' ', 'here!?']
Kesimpulan
Dengan memanfaatkan ungkapan biasa dan kaedah re.split(), adalah mungkin untuk memisahkan rentetan dengan cekap kepada perkataan walaupun teks mengandungi pelbagai pembatas yang berpotensi. Teknik ini amat berguna untuk pemprosesan bahasa semula jadi dan tugasan analisis teks.
Atas ialah kandungan terperinci Bagaimanakah Saya Boleh Membahagikan Rentetan dengan Cekap kepada Perkataan Menggunakan Berbilang Pembatas dalam Python?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Penyelesaian kepada Isu Kebenaran Semasa Melihat Versi Python di Terminal Linux Apabila anda cuba melihat versi Python di Terminal Linux, masukkan Python ...

Artikel ini menerangkan cara menggunakan sup yang indah, perpustakaan python, untuk menghuraikan html. Ia memperincikan kaedah biasa seperti mencari (), find_all (), pilih (), dan get_text () untuk pengekstrakan data, pengendalian struktur dan kesilapan HTML yang pelbagai, dan alternatif (sel

Serialization dan deserialization objek Python adalah aspek utama dari mana-mana program bukan remeh. Jika anda menyimpan sesuatu ke fail python, anda melakukan siri objek dan deserialization jika anda membaca fail konfigurasi, atau jika anda menjawab permintaan HTTP. Dalam erti kata, siri dan deserialization adalah perkara yang paling membosankan di dunia. Siapa yang peduli dengan semua format dan protokol ini? Anda mahu berterusan atau mengalirkan beberapa objek python dan mengambilnya sepenuhnya pada masa yang akan datang. Ini adalah cara yang baik untuk melihat dunia pada tahap konseptual. Walau bagaimanapun, pada tahap praktikal, skim siri, format atau protokol yang anda pilih boleh menentukan kelajuan, keselamatan, kebebasan status penyelenggaraan, dan aspek lain dari program

Artikel ini membandingkan tensorflow dan pytorch untuk pembelajaran mendalam. Ia memperincikan langkah -langkah yang terlibat: penyediaan data, bangunan model, latihan, penilaian, dan penempatan. Perbezaan utama antara rangka kerja, terutamanya mengenai grap pengiraan

Modul Statistik Python menyediakan keupayaan analisis statistik data yang kuat untuk membantu kami dengan cepat memahami ciri -ciri keseluruhan data, seperti biostatistik dan analisis perniagaan. Daripada melihat titik data satu demi satu, cuma melihat statistik seperti min atau varians untuk menemui trend dan ciri dalam data asal yang mungkin diabaikan, dan membandingkan dataset besar dengan lebih mudah dan berkesan. Tutorial ini akan menjelaskan cara mengira min dan mengukur tahap penyebaran dataset. Kecuali dinyatakan sebaliknya, semua fungsi dalam modul ini menyokong pengiraan fungsi min () dan bukan hanya menjumlahkan purata. Nombor titik terapung juga boleh digunakan. Import secara rawak Statistik import dari fracti

Tutorial ini dibina pada pengenalan sebelumnya kepada sup yang indah, memberi tumpuan kepada manipulasi DOM di luar navigasi pokok mudah. Kami akan meneroka kaedah dan teknik carian yang cekap untuk mengubahsuai struktur HTML. Satu kaedah carian dom biasa ialah Ex

Artikel ini membimbing pemaju Python mengenai bangunan baris baris komando (CLI). Butirannya menggunakan perpustakaan seperti Typer, Klik, dan ArgParse, menekankan pengendalian input/output, dan mempromosikan corak reka bentuk mesra pengguna untuk kebolehgunaan CLI yang lebih baik.

Artikel ini membincangkan perpustakaan Python yang popular seperti Numpy, Pandas, Matplotlib, Scikit-Learn, Tensorflow, Django, Flask, dan Permintaan, memperincikan kegunaan mereka dalam pengkomputeran saintifik, analisis data, visualisasi, pembelajaran mesin, pembangunan web, dan h


Alat AI Hot

Undresser.AI Undress
Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover
Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool
Gambar buka pakaian secara percuma

Clothoff.io
Penyingkiran pakaian AI

AI Hentai Generator
Menjana ai hentai secara percuma.

Artikel Panas

Alat panas

MantisBT
Mantis ialah alat pengesan kecacatan berasaskan web yang mudah digunakan yang direka untuk membantu dalam pengesanan kecacatan produk. Ia memerlukan PHP, MySQL dan pelayan web. Lihat perkhidmatan demo dan pengehosan kami.

MinGW - GNU Minimalis untuk Windows
Projek ini dalam proses untuk dipindahkan ke osdn.net/projects/mingw, anda boleh terus mengikuti kami di sana. MinGW: Port Windows asli bagi GNU Compiler Collection (GCC), perpustakaan import yang boleh diedarkan secara bebas dan fail pengepala untuk membina aplikasi Windows asli termasuk sambungan kepada masa jalan MSVC untuk menyokong fungsi C99. Semua perisian MinGW boleh dijalankan pada platform Windows 64-bit.

SublimeText3 versi Mac
Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

SublimeText3 versi Inggeris
Disyorkan: Versi Win, menyokong gesaan kod!

Hantar Studio 13.0.1
Persekitaran pembangunan bersepadu PHP yang berkuasa