communauté

Apprendre

Bibliothèque d'outils

Outils d'IA

Loisirs

Français

Maison

développement back-end

Tutoriel Python

Comment puis-je convertir efficacement du XML en Pandas DataFrame ?

Comment puis-je convertir efficacement du XML en Pandas DataFrame ?

Nov 30, 2024 pm 07:46 PM

How can I convert XML to a Pandas DataFrame efficiently?

Conversion efficace de XML en un DataFrame Pandas

Les fichiers XML peuvent souvent contenir des données précieuses qui peuvent être analysées à l'aide d'outils tels que Pandas. Pour convertir un fichier XML en DataFrame, une approche efficace peut être trouvée ci-dessous :

import pandas as pd
import xml.etree.ElementTree as ET
import io

def iter_docs(author):
    author_attr = author.attrib
    for doc in author.iter('document'):
        doc_dict = author_attr.copy()
        doc_dict.update(doc.attrib)
        doc_dict['data'] = doc.text
        yield doc_dict

xml_data = io.StringIO(u'''YOUR XML STRING HERE''')

etree = ET.parse(xml_data) #create an ElementTree object
doc_df = pd.DataFrame(list(iter_docs(etree.getroot())))

Copier après la connexion

Explication :

La fonction génératrice iter_docs itère sur le Document XML, extrayant les attributs de l'auteur, les attributs du document et le contenu du nœud de texte du document dans un dictionnaire.
Le Pandas DataFrame est ensuite construit à partir d'une liste de dictionnaires générés par la fonction iter_docs.

Notes supplémentaires :

L'exemple XML fourni dans la question suppose un seul auteur. S'il y a plusieurs auteurs, une fonction génératrice supplémentaire, iter_author, peut être utilisée pour parcourir chaque auteur et générer tous leurs dictionnaires de documents respectifs. Cela nécessiterait de modifier la dernière ligne de l'exemple de code en :

doc_df = pd.DataFrame(list(iter_author(etree)))

Copier après la connexion

Pour plus de conseils sur l'utilisation de XML en Python, reportez-vous au didacticiel ElementTree dans la documentation de la bibliothèque XML.

Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Déclaration de ce site Web

Le contenu de cet article est volontairement contribué par les internautes et les droits d'auteur appartiennent à l'auteur original. Ce site n'assume aucune responsabilité légale correspondante. Si vous trouvez un contenu suspecté de plagiat ou de contrefaçon, veuillez contacter admin@php.cn

Article chaud

Combien de temps faut-il pour battre Split Fiction?

3 Il y a quelques semaines By DDD

Repo: Comment relancer ses coéquipiers

3 Il y a quelques semaines By 尊渡假赌尊渡假赌尊渡假赌

Hello Kitty Island Adventure: Comment obtenir des graines géantes

3 Il y a quelques semaines By 尊渡假赌尊渡假赌尊渡假赌

Difficulté à mettre à jour la mise en cache des pages Web officielles du compte: comment éviter l'ancien cache affectant l'expérience utilisateur après la mise à jour de la version?

3 Il y a quelques semaines By 王林

Musée à deux points: toutes les expositions et où les trouver

3 Il y a quelques semaines By 尊渡假赌尊渡假赌尊渡假赌

Afficher plus

Outils chauds Tags

Code&IT

Voix

Entreprise

Commercialisation

Détecteur d'IA

Chatbot

Conception et art

Article chaud

Combien de temps faut-il pour battre Split Fiction?

3 Il y a quelques semaines By DDD

Repo: Comment relancer ses coéquipiers

3 Il y a quelques semaines By 尊渡假赌尊渡假赌尊渡假赌

Hello Kitty Island Adventure: Comment obtenir des graines géantes

3 Il y a quelques semaines By 尊渡假赌尊渡假赌尊渡假赌

Difficulté à mettre à jour la mise en cache des pages Web officielles du compte: comment éviter l'ancien cache affectant l'expérience utilisateur après la mise à jour de la version?

3 Il y a quelques semaines By 王林

Musée à deux points: toutes les expositions et où les trouver

3 Il y a quelques semaines By 尊渡假赌尊渡假赌尊渡假赌

Afficher plus

Tags d'article chaud

Bloc-notes++7.3.1

Bloc-notes++7.3.1

Éditeur de code facile à utiliser et gratuit

SublimeText3 version chinoise

SublimeText3 version chinoise

Version chinoise, très simple à utiliser

Envoyer Studio 13.0.1

Envoyer Studio 13.0.1

Puissant environnement de développement intégré PHP

Dreamweaver CS6

Dreamweaver CS6

Outils de développement Web visuel

SublimeText3 version Mac

SublimeText3 version Mac

Logiciel d'édition de code au niveau de Dieu (SublimeText3)

Afficher plus

Sujets chauds

Où se trouve l'entrée de connexion pour la messagerie Gmail ?

7126

9

Tutoriel Java

1534

14

Tutoriel Laravel

1256

25

Tutoriel PHP

1205

29

Tutoriel CakePHP

1153

46

Afficher plus

Related knowledge

Comment utiliser la belle soupe pour analyser HTML?

Comment utiliser la belle soupe pour analyser HTML? Mar 10, 2025 pm 06:54 PM

Comment utiliser la belle soupe pour analyser HTML?

Filtrage d'image en python

Filtrage d'image en python Mar 03, 2025 am 09:44 AM

Filtrage d'image en python

Comment télécharger des fichiers dans Python

Comment télécharger des fichiers dans Python Mar 01, 2025 am 10:03 AM

Comment télécharger des fichiers dans Python

Comment utiliser Python pour trouver la distribution ZIPF d'un fichier texte

Comment utiliser Python pour trouver la distribution ZIPF d'un fichier texte Mar 05, 2025 am 09:58 AM

Comment utiliser Python pour trouver la distribution ZIPF d'un fichier texte

Comment travailler avec des documents PDF à l'aide de Python

Comment travailler avec des documents PDF à l'aide de Python Mar 02, 2025 am 09:54 AM

Comment travailler avec des documents PDF à l'aide de Python

Comment se cacher en utilisant Redis dans les applications Django

Comment se cacher en utilisant Redis dans les applications Django Mar 02, 2025 am 10:10 AM

Comment se cacher en utilisant Redis dans les applications Django

Comment effectuer l'apprentissage en profondeur avec TensorFlow ou Pytorch?

Comment effectuer l'apprentissage en profondeur avec TensorFlow ou Pytorch? Mar 10, 2025 pm 06:52 PM

Comment effectuer l'apprentissage en profondeur avec TensorFlow ou Pytorch?

Comment implémenter votre propre structure de données dans Python

Comment implémenter votre propre structure de données dans Python Mar 03, 2025 am 09:28 AM

Comment implémenter votre propre structure de données dans Python

See all articles