Heim > Backend-Entwicklung > Python-Tutorial > Wie kann ich eine String-Spalte in einem Pandas-DataFrame effizient in zwei neue Spalten aufteilen?

Wie kann ich eine String-Spalte in einem Pandas-DataFrame effizient in zwei neue Spalten aufteilen?

Mary-Kate Olsen
Freigeben: 2024-12-24 12:55:14
Original
904 Leute haben es durchsucht

How to Efficiently Split a String Column in a Pandas DataFrame into Two New Columns?

Wie teilt man eine Datenrahmen-String-Spalte in zwei Spalten auf?

TL;DR-Version :

Für den einfachen Fall, dass Sie eine Textspalte mit einem Trennzeichen haben und dies möchten Erstellen Sie zwei Spalten, die einfachste Lösung ist:

df[['A', 'B']] = df['AB'].str.split(' ', n=1, expand=True)
Nach dem Login kopieren

Im Detail:

Andy Haydens Ansatz demonstriert effektiv die Leistungsfähigkeit der str.extract()-Methode. Für eine einfache Aufteilung über ein bekanntes Trennzeichen reicht jedoch die Methode .str.split() aus. Es bearbeitet eine Spalte (Reihe) von Zeichenfolgen und gibt eine Spalte (Reihe) von Listen zurück.

Das .str-Attribut einer Spalte ermöglicht es uns, jedes Element in einer Spalte als Zeichenfolge zu behandeln und Methoden effizient anzuwenden. Es verfügt über eine Indexierungsschnittstelle zum Abrufen jedes Elements einer Zeichenfolge anhand seines Index, sodass wir von .str.split() zurückgegebene Listen in Scheiben schneiden und würfeln können.

Python-Tupel-Entpacken kann verwendet werden, um zwei separate Spalten daraus zu erstellen die Liste mit:

df['A'], df['B'] = df['AB'].str.split('-', n=1).str
Nach dem Login kopieren

Alternativ kann man den Parameter expand=True in .str.split() verwenden, um direkt zwei zu generieren Spalten:

df[['A', 'B']] = df['AB'].str.split('-', n=1, expand=True)
Nach dem Login kopieren

Die expand=True-Version ist von Vorteil, wenn es um Teilungen unterschiedlicher Länge geht, da sie solche Fälle behandelt, indem sie Keine-Werte in die Spalten mit fehlenden „Teilungen“ einfügt.

Das obige ist der detaillierte Inhalt vonWie kann ich eine String-Spalte in einem Pandas-DataFrame effizient in zwei neue Spalten aufteilen?. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Quelle:php.cn
Erklärung dieser Website
Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn
Neueste Artikel des Autors
Beliebte Tutorials
Mehr>
Neueste Downloads
Mehr>
Web-Effekte
Quellcode der Website
Website-Materialien
Frontend-Vorlage