Heim > Backend-Entwicklung > Python-Tutorial > Wie erstelle ich effizient mehrere Spalten in einem Pandas DataFrame?

Wie erstelle ich effizient mehrere Spalten in einem Pandas DataFrame?

Susan Sarandon
Freigeben: 2024-10-29 04:24:29
Original
1073 Leute haben es durchsucht

 How to Efficiently Create Multiple Columns in a Pandas DataFrame?

Effizientes Erstellen mehrerer Spalten mit Pandas

Das Anwenden von Funktionen auf eine Pandas-Spalte zum Generieren mehrerer neuer Spalten kann eine häufige Aufgabe sein. Es kann jedoch eine Herausforderung sein, den richtigen Ansatz zu finden, um eine effiziente und korrekte Zuweisung sicherzustellen.

In früheren Versionen von Pandas (vor Version 0.16) wurde häufig die Iteration mit df.iterrows() verwendet. Dies ist jedoch deutlich langsamer als modernere Ansätze. Mit den jüngsten Verbesserungen stehen mehrere effiziente Optionen zur Verfügung.

Ein empfohlener Ansatz verwendet die Funktion zip(), um die Ausgaben der angewendeten Funktion zu entpacken und sie den gewünschten Spalten zuzuweisen. Bei dieser Methode wird für jede Zeile eine Reihe von Tupeln erstellt, wobei jedes Tupel die gewünschten Ausgabewerte enthält. Anschließend werden die Tupel entpackt und den entsprechenden Spalten zugeordnet.

<code class="python">df['p1'], df['p2'], df['p3'], df['p4'], df['p5'], df['p6'] = \
     zip(*df['num'].map(powers))</code>
Nach dem Login kopieren

Es kann auch die Funktion apply() verwendet werden, die einen direkteren Ansatz bietet. Die angewendete Funktion sollte einen Pandas-DataFrame mit der gewünschten Anzahl von Spalten und passenden Zeilenindizes zum Eingabe-DataFrame zurückgeben.

<code class="python">df = df.apply(lambda x: powers(x['num']), axis=1, result_type='expand')</code>
Nach dem Login kopieren

Die in Pandas v0.16 eingeführte Funktion „assign()“ bietet eine weitere praktische Möglichkeit dazu neue Spalten erstellen. Es ermöglicht dem Benutzer, dem DataFrame mithilfe eines Ausdrucks direkt eine neue Spalte zuzuweisen.

<code class="python">df = df.assign(p1=df['num'].map(lambda x: x),
               p2=df['num'].map(lambda x: x**2))</code>
Nach dem Login kopieren

Das obige ist der detaillierte Inhalt vonWie erstelle ich effizient mehrere Spalten in einem Pandas DataFrame?. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Quelle:php.cn
Erklärung dieser Website
Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn
Neueste Artikel des Autors
Beliebte Tutorials
Mehr>
Neueste Downloads
Mehr>
Web-Effekte
Quellcode der Website
Website-Materialien
Frontend-Vorlage