


Comment fonctionnent les pas de temps et les fonctionnalités dans les LSTM Keras ?
Comprendre les pas de temps et les fonctionnalités LSTM
Dans le code Keras donné, le tableau trainX a une forme de (échantillons, pas de temps, caractéristiques ). Cela signifie que les données sont remodelées en un tableau tridimensionnel, où la première dimension représente le nombre d'échantillons, la deuxième dimension représente le nombre de pas de temps et la troisième dimension représente le nombre de caractéristiques.
Dans le contexte du diagramme que vous avez fourni, chaque case verte représente un pas de temps et chaque case rose représente une fonctionnalité. Par conséquent, le code considère le cas « plusieurs contre un », où il existe plusieurs cases roses (caractéristiques) pour chaque case verte (pas de temps).
L'argument des caractéristiques devient pertinent lorsque l'on considère des séries multivariées, telles que modéliser simultanément deux valeurs financières. Dans ce cas, chaque fonctionnalité représenterait l'une des actions, et le nombre de fonctionnalités serait égal au nombre d'actions modélisées.
Comprendre les LSTM avec état
Les LSTM avec état n'enregistrent pas les valeurs de la mémoire des cellules entre les exécutions de lots. Au lieu de cela, ils conservent leur état en interne à travers les lots. Dans le cas du code fourni, où la taille du lot est de un, le LSTM mettra à jour son état interne en fonction de l'entrée actuelle et utilisera cet état pour traiter l'entrée suivante. En réinitialisant les états entre les exécutions d'entraînement, le LSTM est obligé de recommencer à zéro avec chaque lot.
Ce comportement est important pour des cas tels que la prévision des pas de temps futurs, où le modèle doit se souvenir du contexte des entrées passées. pour faire des prédictions précises.
Notes supplémentaires
- Le terme « pas de temps » fait référence au nombre d'éléments séquentiels dans une séquence. Dans le contexte des LSTM, les pas de temps sont généralement considérés comme représentant des intervalles de temps.
- Le terme « caractéristiques » fait référence aux différents types de données utilisés dans un modèle. Par exemple, dans le cas d'un modèle d'action financière, les caractéristiques pourraient être les prix d'ouverture, de clôture, haut et bas de l'action.
Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Outils d'IA chauds

Undresser.AI Undress
Application basée sur l'IA pour créer des photos de nu réalistes

AI Clothes Remover
Outil d'IA en ligne pour supprimer les vêtements des photos.

Undress AI Tool
Images de déshabillage gratuites

Clothoff.io
Dissolvant de vêtements AI

AI Hentai Generator
Générez AI Hentai gratuitement.

Article chaud

Outils chauds

Bloc-notes++7.3.1
Éditeur de code facile à utiliser et gratuit

SublimeText3 version chinoise
Version chinoise, très simple à utiliser

Envoyer Studio 13.0.1
Puissant environnement de développement intégré PHP

Dreamweaver CS6
Outils de développement Web visuel

SublimeText3 version Mac
Logiciel d'édition de code au niveau de Dieu (SublimeText3)

Sujets chauds

Ce tutoriel montre comment utiliser Python pour traiter le concept statistique de la loi de Zipf et démontre l'efficacité de la lecture et du tri de Python de gros fichiers texte lors du traitement de la loi. Vous vous demandez peut-être ce que signifie le terme distribution ZIPF. Pour comprendre ce terme, nous devons d'abord définir la loi de Zipf. Ne vous inquiétez pas, je vais essayer de simplifier les instructions. La loi de Zipf La loi de Zipf signifie simplement: dans un grand corpus en langage naturel, les mots les plus fréquents apparaissent environ deux fois plus fréquemment que les deuxième mots fréquents, trois fois comme les troisième mots fréquents, quatre fois comme quatrième mots fréquents, etc. Regardons un exemple. Si vous regardez le corpus brun en anglais américain, vous remarquerez que le mot le plus fréquent est "th

Cet article explique comment utiliser la belle soupe, une bibliothèque Python, pour analyser HTML. Il détaille des méthodes courantes comme find (), find_all (), select () et get_text () pour l'extraction des données, la gestion de diverses structures et erreurs HTML et alternatives (Sel

Traiter avec des images bruyantes est un problème courant, en particulier avec des photos de téléphones portables ou de caméras basse résolution. Ce tutoriel explore les techniques de filtrage d'images dans Python à l'aide d'OpenCV pour résoudre ce problème. Filtrage d'image: un outil puissant Filtre d'image

Les fichiers PDF sont populaires pour leur compatibilité multiplateforme, avec du contenu et de la mise en page cohérents sur les systèmes d'exploitation, les appareils de lecture et les logiciels. Cependant, contrairement aux fichiers de texte brut de traitement Python, les fichiers PDF sont des fichiers binaires avec des structures plus complexes et contiennent des éléments tels que des polices, des couleurs et des images. Heureusement, il n'est pas difficile de traiter les fichiers PDF avec les modules externes de Python. Cet article utilisera le module PYPDF2 pour montrer comment ouvrir un fichier PDF, imprimer une page et extraire du texte. Pour la création et l'édition des fichiers PDF, veuillez vous référer à un autre tutoriel de moi. Préparation Le noyau réside dans l'utilisation du module externe PYPDF2. Tout d'abord, l'installez en utilisant PIP: pip is p

Ce tutoriel montre comment tirer parti de la mise en cache Redis pour augmenter les performances des applications Python, en particulier dans un cadre Django. Nous couvrirons l'installation redis, la configuration de Django et les comparaisons de performances pour mettre en évidence le bien

Cet article compare TensorFlow et Pytorch pour l'apprentissage en profondeur. Il détaille les étapes impliquées: préparation des données, construction de modèles, formation, évaluation et déploiement. Différences clés entre les cadres, en particulier en ce qui concerne le raisin informatique

Python, un favori pour la science et le traitement des données, propose un écosystème riche pour l'informatique haute performance. Cependant, la programmation parallèle dans Python présente des défis uniques. Ce tutoriel explore ces défis, en se concentrant sur l'interprète mondial

Ce didacticiel montre la création d'une structure de données de pipeline personnalisée dans Python 3, en tirant parti des classes et de la surcharge de l'opérateur pour une fonctionnalité améliorée. La flexibilité du pipeline réside dans sa capacité à appliquer une série de fonctions à un ensemble de données, GE
