Techniques d'exploration de règles d'association en Python-Tutoriel Python-php.cn

Maison

développement back-end

Tutoriel Python

Techniques d'exploration de règles d'association en Python

王林

Jun 09, 2023 pm 11:07 PM

python 关联规则挖掘技巧

Python est un langage de programmation puissant qui peut être appliqué dans divers domaines, notamment l'exploration de données et l'apprentissage automatique. Dans le domaine de l'exploration de données, l'exploration de règles d'association est une technique couramment utilisée qui peut être utilisée pour découvrir les relations entre différents éléments d'un ensemble de données et l'impact de ces relations sur d'autres éléments. Cet article présentera brièvement les techniques d'exploration de règles d'association en Python.

Algorithme Apriori

L'algorithme Apriori est un algorithme classique dans le domaine de l'exploration de règles d'association, qui peut être utilisé pour découvrir des ensembles d'éléments fréquents et des règles d'association dans des ensembles de données. Les ensembles d'éléments fréquents font référence à l'ensemble d'éléments qui apparaissent le plus fréquemment dans l'ensemble de données, tandis que les règles d'association font référence à la relation entre deux éléments ou plus. Ils peuvent apparaître en même temps, ou l'apparition de l'un signifie que l'autre est également probable. apparaître.

Vous pouvez utiliser la fonction apriori de la bibliothèque mlxtend pour implémenter l'algorithme Apriori en Python. Voici un exemple de code simple :

from mlxtend.frequent_patterns import apriori

# 构建数据集
data = [['牛奶', '面包', '啤酒'],
        ['奶酪', '面包', '黄油'],
        ['牛奶', '面包', '黄油', '鸡蛋'],
        ['奶酪', '黄油', '鸡蛋'],
        ['面包', '啤酒']]

# 使用apriori算法挖掘频繁项集
frequent_itemsets = apriori(data, min_support=0.6)

# 输出频繁项集
print(frequent_itemsets)

Copier après la connexion

Dans le code ci-dessus, nous définissons d'abord un ensemble de données qui contient le contenu de cinq paniers d'achat. Utilisez ensuite la fonction apriori de la bibliothèque mlxtend pour extraire des ensembles d'éléments fréquents. Le premier paramètre de la fonction est l'ensemble de données et le deuxième paramètre est le seuil minimum de support, qui est ici fixé à 0,6.

Dans le résultat, nous pouvons voir que l'algorithme a trouvé deux ensembles d'éléments fréquents : ['Bread'] et ['Milk', 'Bread']. Cela signifie que dans cet ensemble de données, le plus grand nombre de personnes achètent du pain, suivi du lait et du pain. Nous pouvons découvrir des ensembles d'éléments fréquents de différentes tailles en ajustant le seuil de support.

Extraction des règles d'association

Après avoir découvert des ensembles d'éléments fréquents, nous pouvons continuer à extraire les règles d'association. Les règles d'association peuvent nous aider à comprendre la probabilité que certains éléments apparaissent ensemble, ou la probabilité qu'un élément apparaisse lorsqu'un autre élément apparaît.

Vous pouvez utiliser la fonction association_rules de la bibliothèque mlxtend pour extraire des règles d'association en Python. Voici un exemple de code simple :

from mlxtend.frequent_patterns import association_rules, apriori

data = [['牛奶', '面包', '啤酒'],
        ['奶酪', '面包', '黄油'],
        ['牛奶', '面包', '黄油', '鸡蛋'],
        ['奶酪', '黄油', '鸡蛋'],
        ['面包', '啤酒']]

# 使用apriori算法挖掘频繁项集
frequent_itemsets = apriori(data, min_support=0.6)

# 使用association_rules函数提取关联规则
rules = association_rules(frequent_itemsets, metric="confidence", min_threshold=0.8)

# 输出关联规则
print(rules)

Copier après la connexion

Dans le code ci-dessus, nous utilisons d'abord l'algorithme Apriori pour trouver les ensembles d'éléments fréquents dans l'ensemble de données. Utilisez ensuite la fonction association_rules pour extraire les règles d'association. Le premier paramètre de la fonction est l'ensemble d'éléments fréquents, le deuxième paramètre est l'indicateur d'évaluation des règles d'association, sélectionnez ici la confiance (confidence), et le troisième paramètre est le seuil de confiance minimum, fixé ici à 0,8.

Dans le résultat, nous pouvons voir que l'algorithme a trouvé une règle d'association avec un niveau de confiance de 1,0 : 'Pain' => 'Bière'. Cela signifie que 100 % des personnes qui ont acheté du pain ont également acheté de la bière. Cette règle d'association peut être utilisée dans les systèmes de recommandation pour recommander des produits aux utilisateurs.

Algorithme FP-Growth

L'algorithme FP-Growth est un autre algorithme classique dans le domaine de l'exploration de règles d'association. Il est plus rapide que l'algorithme Apriori et peut gérer des ensembles de données à grande échelle.

La bibliothèque pyfpgrowth peut être utilisée en Python pour implémenter l'algorithme FP-Growth. Voici un exemple de code simple :

import pyfpgrowth

# 构建数据集
data = [['牛奶', '面包', '啤酒'],
        ['奶酪', '面包', '黄油'],
        ['牛奶', '面包', '黄油', '鸡蛋'],
        ['奶酪', '黄油', '鸡蛋'],
        ['面包', '啤酒']]

# 使用FP-Growth算法挖掘频繁项集
patterns = pyfpgrowth.find_frequent_patterns(data, 2)

# 使用FP-Growth算法提取关联规则
rules = pyfpgrowth.generate_association_rules(patterns, 0.8)

# 输出频繁项集和关联规则
print(patterns)
print(rules)

Copier après la connexion

Dans le code ci-dessus, nous définissons d'abord un ensemble de données, puis utilisons la fonction find_frequent_patterns dans la bibliothèque pyfpgrowth pour extraire des ensembles d'éléments fréquents. Le premier paramètre de la fonction est l'ensemble de données et le deuxième paramètre est le seuil de support. Ici, nous fixons le seuil de support à 2, ce qui signifie que chaque ensemble d'articles doit apparaître dans au moins deux paniers. La fonction renverra un dictionnaire contenant tous les ensembles d'éléments fréquents et leur nombre de supports.

Utilisez ensuite la fonction generate_association_rules dans la bibliothèque pyfpgrowth pour extraire les règles d'association. Le premier paramètre de la fonction est un dictionnaire d'ensembles d'éléments fréquents et le deuxième paramètre est le seuil de confiance. Ici, nous fixons le seuil de confiance à 0,8.

Dans le résultat, nous pouvons voir que l'algorithme a trouvé deux ensembles d'éléments fréquents : ('pain',) et ('pain', 'lait'). Dans le même temps, l'algorithme a extrait une règle d'association avec un niveau de confiance de 1,0 : ('pain',) => ('beer',). Cela signifie que 100 % des personnes qui achètent du pain achèteront de la bière. En plus de cela, vous pouvez également voir d’autres règles d’association avec des niveaux de confiance supérieurs à 0,8.

Résumé

L'exploration de règles d'association est une technique d'exploration de données très utile qui peut être utilisée pour découvrir les relations entre différents éléments d'un ensemble de données et l'impact de ces relations sur d'autres choses. Python fournit diverses méthodes pour implémenter l'exploration de règles d'association, notamment l'algorithme Apriori et l'algorithme FP-Growth. Dans l'implémentation spécifique, vous devez également prêter attention aux paramètres de seuil des ensembles d'éléments fréquents et aux règles d'association, ainsi qu'à la manière de les appliquer à des problèmes réels.

Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Déclaration de ce site Web

Le contenu de cet article est volontairement contribué par les internautes et les droits d'auteur appartiennent à l'auteur original. Ce site n'assume aucune responsabilité légale correspondante. Si vous trouvez un contenu suspecté de plagiat ou de contrefaçon, veuillez contacter admin@php.cn

Outils d'IA chauds

Undresser.AI Undress

Application basée sur l'IA pour créer des photos de nu réalistes

AI Clothes Remover

Outil d'IA en ligne pour supprimer les vêtements des photos.

Undress AI Tool

Images de déshabillage gratuites

Clothoff.io

Dissolvant de vêtements AI

AI Hentai Generator

Générez AI Hentai gratuitement.

Afficher plus

Article chaud

R.E.P.O. Crystals d'énergie expliqués et ce qu'ils font (cristal jaune)

1 Il y a quelques mois By 尊渡假赌尊渡假赌尊渡假赌

R.E.P.O. Meilleurs paramètres graphiques

1 Il y a quelques mois By 尊渡假赌尊渡假赌尊渡假赌

Assassin's Creed Shadows: Solution d'énigmes de coquille

3 Il y a quelques semaines By DDD

Quoi de neuf dans Windows 11 KB5054979 et comment résoudre les problèmes de mise à jour

2 Il y a quelques semaines By DDD

Will R.E.P.O. Vous avez un jeu croisé?

1 Il y a quelques mois By 尊渡假赌尊渡假赌尊渡假赌

Afficher plus

Outils chauds

Bloc-notes++7.3.1

Éditeur de code facile à utiliser et gratuit

SublimeText3 version chinoise

Version chinoise, très simple à utiliser

Envoyer Studio 13.0.1

Puissant environnement de développement intégré PHP

Dreamweaver CS6

Outils de développement Web visuel

SublimeText3 version Mac

Logiciel d'édition de code au niveau de Dieu (SublimeText3)

Afficher plus

Sujets chauds

Où se trouve l'entrée de connexion pour la messagerie Gmail ?

7555

Tutoriel CakePHP

1384

Quel est le format du nom de compte de Steam

Clé d&amp;amp;amp;amp;amp;amp;#39;activation Win11 permanent

NYT Connexions Indices et réponses

Afficher plus

Related knowledge

PHP et Python: exemples de code et comparaison Apr 15, 2025 am 12:07 AM

PHP et Python ont leurs propres avantages et inconvénients, et le choix dépend des besoins du projet et des préférences personnelles. 1.Php convient au développement rapide et à la maintenance des applications Web à grande échelle. 2. Python domine le domaine de la science des données et de l'apprentissage automatique.

Python vs JavaScript: communauté, bibliothèques et ressources Apr 15, 2025 am 12:16 AM

Python et JavaScript ont leurs propres avantages et inconvénients en termes de communauté, de bibliothèques et de ressources. 1) La communauté Python est amicale et adaptée aux débutants, mais les ressources de développement frontal ne sont pas aussi riches que JavaScript. 2) Python est puissant dans les bibliothèques de science des données et d'apprentissage automatique, tandis que JavaScript est meilleur dans les bibliothèques et les cadres de développement frontaux. 3) Les deux ont des ressources d'apprentissage riches, mais Python convient pour commencer par des documents officiels, tandis que JavaScript est meilleur avec MDNWEBDOCS. Le choix doit être basé sur les besoins du projet et les intérêts personnels.

Comment est la prise en charge du GPU pour Pytorch sur Centos Apr 14, 2025 pm 06:48 PM

Activer l'accélération du GPU Pytorch sur le système CentOS nécessite l'installation de versions CUDA, CUDNN et GPU de Pytorch. Les étapes suivantes vous guideront tout au long du processus: CUDA et CUDNN Installation détermineront la compatibilité de la version CUDA: utilisez la commande NVIDIA-SMI pour afficher la version CUDA prise en charge par votre carte graphique NVIDIA. Par exemple, votre carte graphique MX450 peut prendre en charge CUDA11.1 ou plus. Téléchargez et installez Cudatoolkit: visitez le site officiel de Nvidiacudatoolkit et téléchargez et installez la version correspondante selon la version CUDA la plus élevée prise en charge par votre carte graphique. Installez la bibliothèque CUDNN:

Explication détaillée du principe docker Apr 14, 2025 pm 11:57 PM

Docker utilise les fonctionnalités du noyau Linux pour fournir un environnement de fonctionnement d'application efficace et isolé. Son principe de travail est le suivant: 1. Le miroir est utilisé comme modèle en lecture seule, qui contient tout ce dont vous avez besoin pour exécuter l'application; 2. Le Système de fichiers Union (UnionFS) empile plusieurs systèmes de fichiers, ne stockant que les différences, l'économie d'espace et l'accélération; 3. Le démon gère les miroirs et les conteneurs, et le client les utilise pour l'interaction; 4. Les espaces de noms et les CGROUP implémentent l'isolement des conteneurs et les limitations de ressources; 5. Modes de réseau multiples prennent en charge l'interconnexion du conteneur. Ce n'est qu'en comprenant ces concepts principaux que vous pouvez mieux utiliser Docker.

Miniopen Centos Compatibilité Apr 14, 2025 pm 05:45 PM

Minio Object Storage: Déploiement haute performance dans le système Centos System Minio est un système de stockage d'objets distribué haute performance développé sur la base du langage Go, compatible avec Amazons3. Il prend en charge une variété de langages clients, notamment Java, Python, JavaScript et GO. Cet article introduira brièvement l'installation et la compatibilité de Minio sur les systèmes CentOS. Compatibilité de la version CentOS Minio a été vérifiée sur plusieurs versions CentOS, y compris, mais sans s'y limiter: CentOS7.9: fournit un guide d'installation complet couvrant la configuration du cluster, la préparation de l'environnement, les paramètres de fichiers de configuration, le partitionnement du disque et la mini

Comment faire fonctionner la formation distribuée de Pytorch sur CentOS Apr 14, 2025 pm 06:36 PM

La formation distribuée par Pytorch sur le système CentOS nécessite les étapes suivantes: Installation de Pytorch: La prémisse est que Python et PIP sont installés dans le système CentOS. Selon votre version CUDA, obtenez la commande d'installation appropriée sur le site officiel de Pytorch. Pour la formation du processeur uniquement, vous pouvez utiliser la commande suivante: pipinstalltorchtorchVisionTorChaudio Si vous avez besoin d'une prise en charge du GPU, assurez-vous que la version correspondante de CUDA et CUDNN est installée et utilise la version Pytorch correspondante pour l'installation. Configuration de l'environnement distribué: la formation distribuée nécessite généralement plusieurs machines ou des GPU multiples uniques. Lieu

Comment choisir la version Pytorch sur Centos Apr 14, 2025 pm 06:51 PM

Lors de l'installation de Pytorch sur le système CentOS, vous devez sélectionner soigneusement la version appropriée et considérer les facteurs clés suivants: 1. Compatibilité de l'environnement du système: Système d'exploitation: Il est recommandé d'utiliser CentOS7 ou plus. CUDA et CUDNN: La version Pytorch et la version CUDA sont étroitement liées. Par exemple, Pytorch1.9.0 nécessite CUDA11.1, tandis que Pytorch2.0.1 nécessite CUDA11.3. La version CUDNN doit également correspondre à la version CUDA. Avant de sélectionner la version Pytorch, assurez-vous de confirmer que des versions compatibles CUDA et CUDNN ont été installées. Version Python: branche officielle de Pytorch

Python: automatisation, script et gestion des tâches Apr 16, 2025 am 12:14 AM

Python excelle dans l'automatisation, les scripts et la gestion des tâches. 1) Automatisation: La sauvegarde du fichier est réalisée via des bibliothèques standard telles que le système d'exploitation et la fermeture. 2) Écriture de script: utilisez la bibliothèque PSUTIL pour surveiller les ressources système. 3) Gestion des tâches: utilisez la bibliothèque de planification pour planifier les tâches. La facilité d'utilisation de Python et la prise en charge de la bibliothèque riche en font l'outil préféré dans ces domaines.

See all articles