


Bagaimanakah Panda Boleh Mengendalikan Ruang Putih Tidak Teratur dalam Pemisahan CSV?
Menjadikan Pemisah CSV Lebih Fleksibel untuk Ruang Putih Tidak Teratur dalam Panda
Apabila menggunakan pandas.read_csv() untuk mencipta bingkai data daripada fail dengan pemisah lajur tidak teratur , menghadapi cabaran adalah perkara biasa. Sesetengah lajur mungkin dipisahkan oleh tab, manakala yang lain dipisahkan dengan bilangan ruang yang berbeza-beza atau malah gabungan ruang dan tab. Penyelewengan ini boleh membawa kepada isu penghuraian.
Untuk menangani masalah ini, panda menyediakan dua pilihan: menggunakan ungkapan biasa (regex) atau menetapkan delim_whitespace.
Menggunakan Ungkapan Biasa
Pilihan regex membolehkan anda menentukan corak untuk pemisah. Contohnya:
<code class="python">import pandas as pd df = pd.read_csv("file.csv", header=None, delimiter=r"\s+")</code>
Di sini, r"s " sepadan dengan satu atau lebih aksara ruang putih (termasuk ruang dan tab).
Menggunakan delim_whitespace
Pilihan delim_whitespace=True secara automatik mengesan ruang kosong (ruang dan tab) sebagai pemisah:
<code class="python">df = pd.read_csv("file.csv", header=None, delim_whitespace=True)</code>
Perbandingan dengan Kaedah split() Python
Anda menyebutnya dalam Python , anda boleh menggunakan line.split() untuk mengendalikan ruang putih berubah tanpa masalah. pandas.read_csv() menyediakan fleksibiliti yang serupa melalui pilihan delim_whitespace dan regex.
Contoh
Menggunakan fail input berikut (whitespace.csv):
a b c 1 2 d e f 3 4
Kod berikut akan mencipta bingkai data dengan pemisahan lajur yang betul, tanpa mengira jenis pemisah:
<code class="python">df = pd.read_csv("whitespace.csv", header=None, delim_whitespace=True) print(df) 0 1 2 3 4 0 a b c 1 2 1 d e f 3 4</code>
Atas ialah kandungan terperinci Bagaimanakah Panda Boleh Mengendalikan Ruang Putih Tidak Teratur dalam Pemisahan CSV?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Anda boleh mempelajari konsep pengaturcaraan asas dan kemahiran Python dalam masa 2 jam. 1. Belajar Pembolehubah dan Jenis Data, 2.

Python digunakan secara meluas dalam bidang pembangunan web, sains data, pembelajaran mesin, automasi dan skrip. 1) Dalam pembangunan web, kerangka Django dan Flask memudahkan proses pembangunan. 2) Dalam bidang sains data dan pembelajaran mesin, numpy, panda, scikit-learn dan perpustakaan tensorflow memberikan sokongan yang kuat. 3) Dari segi automasi dan skrip, Python sesuai untuk tugas -tugas seperti ujian automatik dan pengurusan sistem.

Anda boleh mempelajari asas -asas Python dalam masa dua jam. 1. Belajar pembolehubah dan jenis data, 2. Struktur kawalan induk seperti jika pernyataan dan gelung, 3 memahami definisi dan penggunaan fungsi. Ini akan membantu anda mula menulis program python mudah.

Bagaimana Mengajar Asas Pengaturcaraan Pemula Komputer Dalam masa 10 jam? Sekiranya anda hanya mempunyai 10 jam untuk mengajar pemula komputer beberapa pengetahuan pengaturcaraan, apa yang akan anda pilih untuk mengajar ...

Cara mengelakkan dikesan semasa menggunakan fiddlerevery di mana untuk bacaan lelaki-dalam-pertengahan apabila anda menggunakan fiddlerevery di mana ...

Memuatkan Fail Pickle di Python 3.6 Kesalahan Laporan Alam Sekitar: ModulenotFoundError: Nomodulenamed ...

Bagaimana untuk menyelesaikan masalah segmentasi kata Jieba dalam analisis komen tempat yang indah? Semasa kami mengadakan komen dan analisis tempat yang indah, kami sering menggunakan alat segmentasi perkataan jieba untuk memproses teks ...

Bagaimana cara menggunakan ungkapan biasa untuk memadankan tag tertutup pertama dan berhenti? Semasa berurusan dengan HTML atau bahasa markup lain, ungkapan biasa sering diperlukan untuk ...


Alat AI Hot

Undresser.AI Undress
Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover
Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool
Gambar buka pakaian secara percuma

Clothoff.io
Penyingkiran pakaian AI

AI Hentai Generator
Menjana ai hentai secara percuma.

Artikel Panas

Alat panas

Versi Mac WebStorm
Alat pembangunan JavaScript yang berguna

MantisBT
Mantis ialah alat pengesan kecacatan berasaskan web yang mudah digunakan yang direka untuk membantu dalam pengesanan kecacatan produk. Ia memerlukan PHP, MySQL dan pelayan web. Lihat perkhidmatan demo dan pengehosan kami.

SecLists
SecLists ialah rakan penguji keselamatan muktamad. Ia ialah koleksi pelbagai jenis senarai yang kerap digunakan semasa penilaian keselamatan, semuanya di satu tempat. SecLists membantu menjadikan ujian keselamatan lebih cekap dan produktif dengan menyediakan semua senarai yang mungkin diperlukan oleh penguji keselamatan dengan mudah. Jenis senarai termasuk nama pengguna, kata laluan, URL, muatan kabur, corak data sensitif, cangkerang web dan banyak lagi. Penguji hanya boleh menarik repositori ini ke mesin ujian baharu dan dia akan mempunyai akses kepada setiap jenis senarai yang dia perlukan.

VSCode Windows 64-bit Muat Turun
Editor IDE percuma dan berkuasa yang dilancarkan oleh Microsoft

Muat turun versi mac editor Atom
Editor sumber terbuka yang paling popular