broker-forex.fr

Modèles de Markov cachés (HMM) : détecter les régimes de marché en trading

Schéma d'un modèle de Markov caché : états cachés, transitions et observations

Mis à jour le 6 octobre 2026 par l'Équipe de broker-forex.fr

Les marchés financiers ne se comportent pas de la même manière en permanence : des phases calmes et haussières alternent avec des périodes de stress où la volatilité explose. Le problème est que personne ne sonne la cloche lors du passage de l'une à l'autre. Les modèles de Markov cachés (MMC, ou HMM pour Hidden Markov Models) ont précisément été conçus pour estimer un état que l'on ne voit pas à partir de données que l'on voit.

Issus de la reconnaissance vocale et de la bio-informatique, ils sont utilisés en finance quantitative pour identifier les régimes de marché et adapter en conséquence les stratégies de trading, la gestion du risque et l'allocation d'actifs. Ce guide explique leur fonctionnement, donne un exemple chiffré et détaille leurs applications comme leurs limites.

L'essentiel en bref

  • Un modèle de Markov caché relie des états non observables (régime haussier, baissier, volatilité forte ou faible) à des données observables (rendements, volatilité, volumes).
  • Il fournit une probabilité d'être dans chaque régime, et non une certitude, ce qui en fait un outil d'aide à la décision.
  • En pratique, il sert surtout de filtre pour ajuster l'exposition d'une stratégie ou d'un portefeuille au régime en cours.
  • Ses faiblesses : détection en retard, risque de surajustement et forte dépendance aux données historiques.

Qu'est-ce qu'un modèle de Markov caché ?

Un modèle de Markov caché, ou MMC (en anglais Hidden Markov Model, HMM), est un modèle statistique qui décrit un système passant d'un état à un autre au fil du temps, sans que ces états soient directement visibles. On n'observe que leurs conséquences : des données « émises » par l'état en cours.

L'image classique est celle de la météo. Imaginez une personne enfermée dans une pièce sans fenêtre : elle ne voit pas le temps qu'il fait (l'état caché : pluie, nuages ou soleil), mais elle voit l'humeur des gens qui entrent (l'observation). Jour après jour, elle peut en déduire le temps probable à l'extérieur, et même anticiper celui du lendemain si elle sait que le beau temps a tendance à durer.

En finance, le raisonnement est le même. Personne n'affiche à l'écran « le marché est en régime de crise » : le régime de marché est l'état caché. Ce que l'on observe, ce sont les rendements, la volatilité, les volumes ou les écarts de taux. Le modèle remonte de ces observations vers le régime le plus probable.

Chaîne de Markov ou modèle de Markov caché ? Dans une chaîne de Markov simple, l'état est observé directement (par exemple « séance en hausse » ou « séance en baisse »). Dans un modèle de Markov caché, l'état est invisible et doit être estimé à partir de données bruitées. Dans les deux cas s'applique la propriété de Markov : l'état de demain ne dépend que de l'état d'aujourd'hui, pas de tout l'historique.

De Markov à Hamilton : les origines

Les fondations sont posées par le mathématicien russe Andreï Markov, qui étudie au début du XXe siècle les suites d'événements dont chaque terme ne dépend que du précédent. Les modèles « cachés » apparaissent dans les années 1960 aux États-Unis, avec les travaux de Leonard Baum et de ses collègues, qui mettent au point la méthode d'estimation encore utilisée aujourd'hui.

DateAuteurContribution
1906-1913Andreï MarkovThéorie des chaînes qui portent son nom
Années 1960Leonard Baum et coauteursFormalisation des modèles de Markov cachés et de leur estimation (algorithme de Baum-Welch)
1967Andrew ViterbiAlgorithme de décodage de la séquence d'états la plus probable
Années 1970-1980Recherche en reconnaissance vocalePremières applications industrielles à grande échelle
1989James HamiltonModèle à changement de régime markovien appliqué aux cycles économiques américains

C'est l'article de James Hamilton, publié en 1989 dans la revue Econometrica, qui installe durablement ces outils en économie et en finance : il montre que la croissance américaine alterne entre deux régimes, expansion et récession, dont on peut estimer la probabilité à chaque date. Depuis, les modèles à changement de régime sont utilisés pour l'étude des cycles, des taux de change, de la volatilité des actions et de l'allocation d'actifs.

Les cinq composantes d'un HMM

Un modèle de Markov caché est entièrement défini par cinq éléments.

ComposanteDéfinitionExemple sur un marché actions
États cachésLes situations possibles du système, non observablesRégime calme, régime turbulent
ObservationsLes données visibles produites par l'état en coursRendement quotidien de l'indice
Probabilités de transitionProbabilité de passer d'un état à un autre entre deux dates95 % de chances de rester en régime calme le lendemain
Probabilités d'émissionLoi des observations dans chaque étatRendements peu dispersés en régime calme, très dispersés en régime turbulent
Probabilités initialesProbabilité de se trouver dans chaque état au départ67 % calme, 33 % turbulent

Les probabilités de transition sont rangées dans une matrice de transition, dont chaque ligne totalise 100 %. Les valeurs situées sur la diagonale mesurent la persistance des régimes : plus elles sont proches de 100 %, plus un régime dure longtemps une fois installé.

Sur les marchés, les émissions sont le plus souvent modélisées par une loi normale propre à chaque régime (moyenne et écart-type différents). L'ensemble produit un mélange de lois normales, capable de reproduire les queues épaisses et les grappes de volatilité que le modèle brownien classique, à volatilité constante, ne sait pas représenter.

Les trois problèmes fondamentaux et leurs algorithmes

L'utilisation d'un HMM revient à résoudre trois problèmes, chacun associé à un algorithme.

ProblèmeQuestion poséeAlgorithme
ÉvaluationQuelle est la vraisemblance d'une séquence d'observations, les paramètres étant connus ?Algorithme forward (avant)
DécodageQuelle est la séquence d'états cachés la plus probable ?Algorithme de Viterbi
ApprentissageQuels paramètres rendent les observations les plus vraisemblables ?Algorithme de Baum-Welch (espérance-maximisation)

Pour le trader, une distinction pratique est essentielle :

  • les probabilités filtrées estiment le régime du jour à partir des seules données disponibles jusqu'à ce jour. Ce sont les seules utilisables en temps réel ;
  • les probabilités lissées (et le décodage de Viterbi) utilisent l'échantillon complet, y compris les données postérieures à la date étudiée. Elles donnent de très beaux graphiques rétrospectifs, mais elles sont inutilisables pour décider.

Piège classique : un backtest construit sur des régimes lissés ou décodés sur tout l'historique « connaît l'avenir ». Ses performances sont illusoires. Un test honnête n'utilise que les probabilités filtrées, avec un modèle réestimé uniquement sur les données passées.

Exemple chiffré : un modèle à deux régimes

Prenons un modèle simplifié à deux régimes pour un indice actions, observé en données quotidiennes. Les paramètres ci-dessous sont illustratifs : ils ne proviennent pas d'une estimation sur un marché précis.

ParamètreRégime calmeRégime turbulent
Rendement quotidien moyen+0,05 %−0,10 %
Écart-type quotidien0,70 %2,00 %
Probabilité de rester dans le régime le lendemain95 %90 %
Probabilité de changer de régime5 %10 %

Durée moyenne des régimes. Elle vaut 1 / (1 − persistance). Le régime calme dure en moyenne 1 / 0,05 = 20 séances, le régime turbulent 1 / 0,10 = 10 séances.

Répartition à long terme. La part du temps passée en régime calme vaut 0,10 / (0,05 + 0,10) = 66,7 %, contre 33,3 % en régime turbulent.

Mise à jour après une séance. Supposons que le modèle attribuait hier 90 % de probabilité au régime calme, et que l'indice perde aujourd'hui 2,5 %.

ÉtapeCalculRésultat
Prévision du régime calme avant la séance0,90 × 0,95 + 0,10 × 0,1086,5 %
Prévision du régime turbulent avant la séance1 − 0,86513,5 %
Densité d'un rendement de −2,5 % en régime calmeLoi normale (0,05 % ; 0,70 %)0,00075
Densité d'un rendement de −2,5 % en régime turbulentLoi normale (−0,10 % ; 2,00 %)0,0971
Probabilité du régime turbulent après la séance0,135 × 0,0971 / (0,135 × 0,0971 + 0,865 × 0,00075)≈ 95,3 %

Une seule séance très inhabituelle pour un marché calme (plus de 3,6 écarts-types) suffit à faire passer la probabilité du régime turbulent de 13,5 % à plus de 95 %. Comme ce régime est persistant, le modèle anticipe encore environ 86 % de chances d'y être le lendemain. C'est exactement le type d'information qu'un trader peut utiliser pour réduire son levier ou la taille de ses positions.

Applications en finance et en trading

Les HMM sont nés hors de la finance : ils ont longtemps été la technologie de référence de la reconnaissance vocale (les sons sont les observations, les mots les états cachés) et restent très utilisés en bio-informatique pour la recherche de gènes et l'analyse de protéines. Sur les marchés, leurs usages se concentrent autour de la notion de régime.

Détection des régimes de marché

C'est l'application principale : distinguer marché haussier, baissier ou sans tendance, ou encore volatilité faible et volatilité élevée. Chaque régime correspond à un comportement distinct de l'actif. Un trader qui applique une stratégie de suivi de tendance (ou momentum), fondée sur l'idée que le mouvement récent se prolonge, peut ainsi n'activer sa stratégie que lorsque le modèle identifie un régime directionnel et la mettre en veille en régime latéral.

Filtrage et pilotage des stratégies

Plutôt que de générer directement des signaux d'achat et de vente, le HMM sert souvent de filtre placé au-dessus d'un système de trading existant : exposition pleine en régime favorable, exposition réduite, couverture ou position vendeuse en régime défavorable.

Évaluation du risque

Les volatilités et les corrélations ne sont pas stables : elles augmentent brutalement en période de stress. En estimant un jeu de paramètres par régime, le modèle fournit une vision plus nuancée de la contribution de chaque actif au risque du portefeuille, et des mesures comme la VaR et la CVaR conditionnelles au régime en cours.

Allocation dynamique d'actifs

Une fois les régimes identifiés, l'allocation peut être ajustée. Dans un portefeuille construit en parité des risques, un régime de forte volatilité conduira par exemple à renforcer les actifs défensifs, comme les obligations d'État à court terme, et à alléger les actifs risqués.

Diversification du portefeuille

Connaître le comportement de chaque classe d'actifs selon le régime aide à vérifier qu'un portefeuille reste équilibré dans plusieurs environnements, et pas seulement dans celui qui a dominé la période récente. Voir aussi notre guide sur la répartition des actifs et la diversification.

Construire un HMM de régimes de marché en 6 étapes

La mise en œuvre ne demande pas de programmer les algorithmes soi-même : des bibliothèques libres existent en Python (hmmlearn, statsmodels pour les modèles à changement de régime) et en R. La difficulté est méthodologique.

1
Choisir les observations

Utilisez des séries stationnaires : rendements logarithmiques plutôt que prix, éventuellement complétés par la volatilité réalisée, les volumes ou un indicateur de stress. Évitez d'empiler des variables redondantes.

2
Fixer le nombre d'états

Commencez par deux régimes, éventuellement trois. Les critères d'information (AIC, BIC) aident à comparer les versions, mais un modèle qui a besoin de cinq ou six états pour « coller » aux données est le plus souvent surajusté.

3
Estimer les paramètres

L'algorithme de Baum-Welch converge vers un optimum local : relancez l'estimation avec plusieurs initialisations aléatoires et conservez la solution la plus vraisemblable.

4
Interpréter les régimes

Les états sont numérotés arbitrairement par le logiciel. Examinez la moyenne, la volatilité et la persistance de chacun pour leur donner un sens économique. Un régime qui ne dure qu'une ou deux séances n'est pas exploitable.

5
Tester hors échantillon

Réestimez le modèle sur fenêtre glissante et n'utilisez que les probabilités filtrées. Comparez le résultat à une règle simple, par exemple un filtre de volatilité, pour vérifier que la complexité apporte quelque chose.

6
Relier le régime à une règle de gestion

Définissez à l'avance ce que chaque régime implique : niveau d'exposition, levier, type de stratégie active. Complétez par des tests de robustesse, par exemple une simulation de Monte-Carlo.

Avantages et limites des modèles de Markov cachés

Avantages
  • Cadre probabiliste : le modèle donne une probabilité de régime, pas un verdict binaire
  • Reproduit les grappes de volatilité et les queues épaisses des rendements
  • Régimes interprétables, contrairement à beaucoup de modèles d'apprentissage automatique
  • Peu de paramètres dans sa version à deux états, donc estimation rapide
  • S'ajoute facilement comme filtre à une stratégie existante
Inconvénients
  • Détection toujours en retard : un changement de régime n'est confirmé qu'après coup
  • Nombre d'états à choisir par l'utilisateur, avec un fort risque de surajustement
  • Hypothèses simplificatrices sur la mémoire et la durée des régimes
  • Paramètres supposés stables alors que les marchés évoluent
  • Estimation sensible à l'initialisation et à la période de données retenue

Plusieurs de ces limites méritent d'être précisées.

  • Hypothèses d'indépendance. Le modèle suppose que l'état futur ne dépend que de l'état présent et que, une fois le régime connu, les observations sont indépendantes entre elles. Les marchés ont pourtant une mémoire plus longue, notamment en matière de volatilité.
  • Durée des régimes. La structure du modèle implique que la probabilité de quitter un régime est la même au premier jour et au centième. En réalité, un marché haussier ancien n'a pas forcément le même profil qu'un marché haussier naissant.
  • Nombre et nature des états. Rien ne garantit que les états estimés correspondent aux régimes « haussier » et « baissier » espérés. Le modèle sépare très souvent les données selon la volatilité plutôt que selon la direction.
  • Complexité croissante. Le nombre de paramètres augmente rapidement avec le nombre d'états et de variables observées, ce qui alourdit les calculs et fragilise l'estimation.
  • Dépendance aux données. Un régime jamais rencontré dans l'historique ne peut pas être reconnu. La qualité et la représentativité des données conditionnent toute la démarche.
  • Expertise requise. L'interprétation des résultats demande de solides bases statistiques ; un HMM mal compris donne une fausse impression de précision.

Les modèles qui prolongent le HMM

Pour dépasser ces limites, la recherche a proposé plusieurs variantes.

ModèleCe qu'il ajoute
Modèle à changement de régime markovien (Hamilton)Une dynamique autorégressive des observations à l'intérieur de chaque régime
Modèles GARCH à changement de régimeUne volatilité qui varie aussi au sein de chaque régime
Modèles semi-markoviens cachésUne loi explicite pour la durée des régimes
HMM à probabilités de transition variablesDes transitions qui dépendent de variables économiques (taux, spreads de crédit, etc.)
HMM à émissions par mélange de gaussiennesDes distributions plus souples dans chaque état
Filtre de KalmanLe cas voisin où l'état caché est continu et non discret

Les réseaux de neurones ont remplacé les HMM en reconnaissance vocale, et ils sont de plus en plus testés sur les données financières (voir notre dossier sur l'IA dans le trading). En finance, où les données sont peu nombreuses et très bruitées, la sobriété et la lisibilité des modèles de Markov cachés restent toutefois un avantage réel.

Ce que le trader peut en retenir

Même sans estimer soi-même un modèle, l'approche par régimes apporte plusieurs enseignements pratiques.

  • Une stratégie n'est pas rentable partout. Le suivi de tendance souffre en marché latéral, le retour à la moyenne souffre en tendance forte. Identifier les conditions dans lesquelles sa méthode fonctionne compte autant que la méthode elle-même.
  • La volatilité arrive par grappes. Après une séance violente, la probabilité d'autres séances violentes augmente. Adapter la taille de ses positions à ce contexte relève de la gestion du risque de base.
  • Raisonner en probabilités. Un régime n'est jamais certain : il se décrit par un degré de confiance, dans l'esprit de la théorie des probabilités appliquée au trading.
  • Accepter le retard. Aucun modèle n'identifie un retournement au jour près. L'objectif réaliste est d'éviter une partie des phases défavorables, pas de sortir au plus haut.
  • Se méfier des backtests trop beaux. Les régimes dessinés a posteriori sur un graphique paraissent toujours évidents. Seul un test hors échantillon indique ce que le modèle aurait réellement signalé en temps réel.

Rappel : un modèle statistique ne supprime pas le risque de perte, en particulier sur les produits à effet de levier. Selon l'étude de l'AMF menée sur quatre ans, plus de 89 % des clients particuliers actifs sur les CFD et le Forex sont perdants.

Conclusion

Les modèles de Markov cachés partent d'une idée simple : les marchés traversent des phases différentes, que l'on ne voit pas directement mais que les prix trahissent. En associant à chaque phase sa propre loi de rendement et une probabilité de transition, ils transforment cette intuition en un outil mesurable, utile pour filtrer une stratégie, ajuster une exposition ou piloter une allocation.

Leur intérêt tient autant à ce qu'ils disent qu'à ce qu'ils ne promettent pas. Un HMM ne prédit pas le prochain mouvement de cours ; il estime, avec retard et incertitude, l'environnement dans lequel on se trouve. Utilisé avec peu d'états, testé hors échantillon et relié à des règles de gestion définies à l'avance, il constitue un complément solide à l'analyse classique. Utilisé comme une boîte noire, il n'ajoute qu'une couche de complexité.

Compte démo gratuit