Wie zählt man mit Pandas eindeutige Werte in Gruppen?-Python-Tutorial-php.cn

Heim

Backend-Entwicklung

Python-Tutorial

Wie zählt man mit Pandas eindeutige Werte in Gruppen?

Patricia Arquette

Oct 18, 2024 pm 03:52 PM

How to Count Unique Values in Groups with Pandas?

Eindeutige Werte in Gruppen mit Pandas zählen

Bei der Arbeit mit Datensätzen, die mehrere in Kategorien gruppierte Variablen enthalten, ist es oft notwendig, die Anzahl zu bestimmen einzigartiger Werte, die jeder Gruppe zugeordnet sind. Pandas, eine weit verbreitete Python-Bibliothek zur Datenbearbeitung, bietet mehrere Methoden zum Zählen eindeutiger Werte innerhalb von Gruppen.

Eine häufige Anforderung besteht darin, die Anzahl eindeutiger Bezeichner innerhalb jeder Domäne zu zählen. Anhand eines Datenrahmens mit Spalten für ID und Domäne möchten wir ein Ergebnis erhalten, das die Anzahl der eindeutigen IDs für jede Domäne anzeigt.

Insbesondere unter Berücksichtigung der Daten:

      ID   domain
0    123   vk.com
1    123   vk.com
2    123  twitter.com
3    456   vk.com
4    456  facebook.com
5    456   vk.com
6    456   google.com
7    789  twitter.com
8    789   vk.com

Wir Ziel ist es, die folgende Ausgabe zu erzielen:

domain  count
vk.com       3
twitter.com   2
facebook.com  1
google.com    1

Um dies zu erreichen, können wir die Funktion nunique() innerhalb der Pandas-Groupby-Operation verwenden. Indem wir den Datenrahmen nach der Domänenspalte gruppieren und anschließend die Funktion nunique() auf die ID-Spalte anwenden, erhalten wir die Anzahl der eindeutigen Werte für jede Domäne. Der resultierende Datenrahmen enthält das gewünschte Ergebnis:

df = df.groupby(['domain', 'ID']).nunique()

print(df)

In bestimmten Szenarien können die Daten jedoch Zeichen wie einfache Anführungszeichen innerhalb der Domänennamen enthalten. Um solche Fälle zu behandeln, können wir die Funktion str.strip("'") verwenden, um die einfachen Anführungszeichen vor dem Gruppieren und Zählen zu entfernen. Dies kann wie folgt implementiert werden:

df = df.ID.groupby([df.domain.str.strip("'")]).nunique()

print(df)

Alternativ können wir den Code vereinfachen, indem wir die Funktion str.strip("'") innerhalb der Groupby-Operation verketten:

df.groupby(df.domain.str.strip("'"))['ID'].nunique()

Zur Beibehaltung Für die Domänenspalte im resultierenden Datenrahmen können wir die Funktion agg() mit dem Parameter as_index=False verwenden:

df = df.groupby(by='domain', as_index=False).agg({'ID': pd.Series.nunique})

print(df)

Diese Methode gibt einen Datenrahmen mit sowohl der Domänen- als auch der Anzahlspalte zurück, wobei count stellt die Anzahl der eindeutigen IDs dar, die jeder Domäne zugeordnet sind.

Das obige ist der detaillierte Inhalt vonWie zählt man mit Pandas eindeutige Werte in Gruppen?. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Stellungnahme

Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn

Verwandter Artikel

Der Hauptzweck von Python: Flexibilität und BenutzerfreundlichkeitApr 17, 2025 am 12:14 AM

Die Flexibilität von Python spiegelt sich in Multi-Paradigm-Unterstützung und dynamischen Typsystemen wider, während eine einfache Syntax und eine reichhaltige Standardbibliothek stammt. 1. Flexibilität: Unterstützt objektorientierte, funktionale und prozedurale Programmierung und dynamische Typsysteme verbessern die Entwicklungseffizienz. 2. Benutzerfreundlichkeit: Die Grammatik liegt nahe an der natürlichen Sprache, die Standardbibliothek deckt eine breite Palette von Funktionen ab und vereinfacht den Entwicklungsprozess.

Python: Die Kraft der vielseitigen ProgrammierungApr 17, 2025 am 12:09 AM

Python ist für seine Einfachheit und Kraft sehr beliebt, geeignet für alle Anforderungen von Anfängern bis hin zu fortgeschrittenen Entwicklern. Seine Vielseitigkeit spiegelt sich in: 1) leicht zu erlernen und benutzten, einfachen Syntax; 2) Reiche Bibliotheken und Frameworks wie Numpy, Pandas usw.; 3) plattformübergreifende Unterstützung, die auf einer Vielzahl von Betriebssystemen betrieben werden kann; 4) Geeignet für Skript- und Automatisierungsaufgaben zur Verbesserung der Arbeitseffizienz.

Python in 2 Stunden am Tag lernen: Ein praktischer LeitfadenApr 17, 2025 am 12:05 AM

Ja, lernen Sie Python in zwei Stunden am Tag. 1. Entwickeln Sie einen angemessenen Studienplan, 2. Wählen Sie die richtigen Lernressourcen aus, 3. Konsolidieren Sie das durch die Praxis erlernte Wissen. Diese Schritte können Ihnen helfen, Python in kurzer Zeit zu meistern.

Python gegen C: Vor- und Nachteile für EntwicklerApr 17, 2025 am 12:04 AM

Python eignet sich für eine schnelle Entwicklung und Datenverarbeitung, während C für hohe Leistung und zugrunde liegende Kontrolle geeignet ist. 1) Python ist einfach zu bedienen, mit prägnanter Syntax, und eignet sich für Datenwissenschaft und Webentwicklung. 2) C hat eine hohe Leistung und eine genaue Kontrolle und wird häufig bei der Programmierung von Spielen und Systemen verwendet.

Python: zeitliches Engagement und LerntempoApr 17, 2025 am 12:03 AM

Die Zeit, die zum Erlernen von Python erforderlich ist, variiert von Person zu Person, hauptsächlich von früheren Programmiererfahrungen, Lernmotivation, Lernressourcen und -methoden und Lernrhythmus. Setzen Sie realistische Lernziele und lernen Sie durch praktische Projekte am besten.

Python: Automatisierung, Skript- und AufgabenverwaltungApr 16, 2025 am 12:14 AM

Python zeichnet sich in Automatisierung, Skript und Aufgabenverwaltung aus. 1) Automatisierung: Die Sicherungssicherung wird durch Standardbibliotheken wie OS und Shutil realisiert. 2) Skriptschreiben: Verwenden Sie die PSUTIL -Bibliothek, um die Systemressourcen zu überwachen. 3) Aufgabenverwaltung: Verwenden Sie die Zeitplanbibliothek, um Aufgaben zu planen. Die Benutzerfreundlichkeit von Python und die Unterstützung der reichhaltigen Bibliothek machen es zum bevorzugten Werkzeug in diesen Bereichen.

Python und Zeit: Machen Sie das Beste aus Ihrer StudienzeitApr 14, 2025 am 12:02 AM

Um die Effizienz des Lernens von Python in einer begrenzten Zeit zu maximieren, können Sie Pythons DateTime-, Zeit- und Zeitplanmodule verwenden. 1. Das DateTime -Modul wird verwendet, um die Lernzeit aufzuzeichnen und zu planen. 2. Das Zeitmodul hilft, die Studie zu setzen und Zeit zu ruhen. 3. Das Zeitplanmodul arrangiert automatisch wöchentliche Lernaufgaben.

Python: Spiele, GUIs und mehrApr 13, 2025 am 12:14 AM

Python zeichnet sich in Gaming und GUI -Entwicklung aus. 1) Spielentwicklung verwendet Pygame, die Zeichnungen, Audio- und andere Funktionen bereitstellt, die für die Erstellung von 2D -Spielen geeignet sind. 2) Die GUI -Entwicklung kann Tkinter oder Pyqt auswählen. Tkinter ist einfach und einfach zu bedienen. PYQT hat reichhaltige Funktionen und ist für die berufliche Entwicklung geeignet.

See all articles