Backtesting et reproductibilité|4 causes qui la brisent
En backtesting tout allait bien, mais en trading réel vous n'arrivez pas à prendre la même décision — nous analysons ce phénomène non pas comme un problème mental, mais comme un problème de structure, en le décomposant en 4 causes qui brisent la reproductibilité.
En backtesting vous êtes entré, mais en trading réel la peur vous a empêché d'entrer. En test vous avez respecté votre stop loss selon vos critères, mais en trading réel vous n'avez pas tenu la règle. Une procédure qui fonctionnait en test s'est révélée non reproductible en trading réel — cette expérience est commune à de nombreux traders.
Beaucoup rangent cela dans la « faiblesse mentale ». Pourtant, s'il y a non-reproductibilité, c'est pour des raisons structurelles. Dans cet article, nous décomposons en 4 causes l'écart qui naît entre le backtesting et les conditions réelles.
L'objectif du backtesting n'est pas « avez-vous gagné ». C'est « pouvez-vous répéter la même décision sur les marchés à venir ». Vu sous cet angle, ce qu'il faut corriger devient clair.
(Le fonctionnement et la prise en main de Chart Replay lui-même sont expliqués dans un autre article, « Qu'est-ce que Chart Replay ? Comment s'entraîner au trading d'actions sur des graphiques passés ». Cet article aborde l'étape suivante : le mur du « j'ai fait le test, mais je n'arrive pas à le reproduire ».)
Ce que le backtesting doit questionner : non pas « avez-vous gagné » mais « est-ce reproductible »
Quand on fait un backtesting, on regarde vite « le total est-il positif » ou « quel était le taux de réussite ». Mais la vraie valeur du test n'est pas là.
Ce qu'il faut vérifier en test, c'est si, lorsque la même configuration se présente, vous pouvez reproduire la même décision. Un test dont le profit est venu par hasard n'est pas reproductible en trading réel. À l'inverse, si la procédure de décision est mise en mots et que vous agissez de la même manière à chaque fois, alors elle a de fortes chances de fonctionner en trading réel.
La vraie nature du « ça marchait en test mais pas en trading réel »
Le sentiment « c'était bon en backtesting, mais en trading réel je n'arrive pas à prendre la même décision » a une cause précise. La situation au moment du test et la situation réelle divergent sur plusieurs points.
Cet écart ne se comble pas à la volonté ou au courage. Pour le combler, il faut comprendre comme une structure où se situe le décalage.
Ce n'est pas un problème mental mais un problème de structure
Beaucoup d'articles sur la reproductibilité en trading se terminent sur un discours mental : « vaincs ta peur », « abandonne ta cupidité ». C'est un aspect des choses, mais cela seul n'améliore pas la reproductibilité.
La plupart des causes de non-reproductibilité sont dans la structure, pas dans le mental. Les voici, au nombre de quatre.
Cause 1 : le graphique que vous voyiez était différent Cause 2 : vous n'avez pas vu la même configuration un nombre suffisant de fois Cause 3 : vos critères de décision ne sont pas mis en mots Cause 4 : vous n'analysez pas vos résultats
Voyons-les une à une.
Cause 1 : le graphique que vous voyiez était différent
C'est la première cause, et celle qu'on néglige souvent. L'écran que vous regardiez pendant le test et celui que vous regardez en trading réel sont, à la base, différents.
En réel la bougie hebdomadaire est « en formation », en test seule la bougie clôturée
Sur les marchés réels, sur les unités de temps supérieures (bougie hebdomadaire, mensuelle), « la toute dernière bougie en train de se former » s'allonge et se rétracte au gré des mouvements quotidiens. En milieu de semaine, la bougie hebdomadaire forme-t-elle une mèche haute en perdant son élan, ou étend-elle vigoureusement son corps ? — le trader décide en observant cette évolution en cours.
Par exemple, une semaine qui, revue uniquement en bougies clôturées, apparaît comme une belle bougie haussière, peut à mi-semaine — où l'on ne voit que les mouvements jusqu'à cet instant — donner par moments l'image d'une forte baisse. Pour une même bougie hebdomadaire, l'impression reçue change complètement selon qu'on la voit en cours de route ou après sa clôture. Si l'apparence diffère, la décision prise à ce moment change aussi.
Or, même en avançant les unités de temps inférieures (bougie journalière) une par une dans un replay classique, il arrive que l'unité de temps supérieure n'affiche qu'une « bougie clôturée achevée » tant que la semaine ou le mois n'est pas terminé. L'écran vu en test et l'écran vu en temps réel en trading réel divergent alors. C'est l'une des causes les plus profondes du sentiment « ça marchait en test mais pas en trading réel ».
Pour supprimer cet écart, ENTRIQ intègre une approche appelée forming bar method (bougie clôturée + bougie en formation). À chaque fois que vous avancez d'une bougie sur l'unité de temps inférieure, l'unité de temps supérieure est redessinée en temps réel comme une « bougie en formation ». Ainsi, l'écran de test se rapproche de l'apparence réelle.
L'apparence des unités de temps supérieures n'est pas alignée
Le même problème s'étend à toute l'analyse multi-timeframe. Alors que vous décidez en passant de la bougie journalière à l'hebdomadaire et à la mensuelle, si en test chacune de ces unités de temps n'est pas alignée comme en trading réel, le socle de votre décision s'effondre.
La méthode pour visualiser plusieurs unités de temps synchronisées comme en trading réel est détaillée dans un autre article, « Tester simultanément bougies journalière, hebdomadaire et mensuelle|multi-écran et multi-display ».
Cause 2 : vous n'avez pas vu la même configuration un nombre suffisant de fois
La deuxième cause touche directement à la valeur d'ENTRIQ. Il ne s'agit pas d'un simple volume d'entraînement, mais du fait de ne pas avoir vu le même type de configuration un nombre suffisant de fois.
Avoir vu 3 fois et avoir vu 300 fois, ce n'est pas la même chose
Entre quelqu'un qui n'a vu une configuration graphique que 3 fois et quelqu'un qui l'a vue 300 fois, la réaction face à la même configuration est totalement différente. À 3 fois, on « connaît » seulement ; à 300 fois, on parvient à réagir avant même de réfléchir au moment où la forme se casse ou face à un signe de fausse cassure.
Ce qui est particulièrement efficace, c'est la répétition de configurations spécifiques comme les krachs. En conditions réelles, un krach ne survient qu'une fois tous les quelques années. Mais avec le backtesting, vous pouvez vous entraîner autant de fois que vous voulez, aussi bien sur le krach de 2008 (crise des subprimes/Lehman) que sur la chute brutale du krach du Covid. Plus une configuration est rarement rencontrée d'ordinaire, plus il est précieux de s'y « habituer » avant le jour réel.
La reproductibilité naît non pas du temps, mais du nombre de répétitions.
Vouloir accumuler ce nombre de fois en trading réel seulement prendrait des années. Pouvoir répéter la même configuration autant de fois que l'on veut avec un capital virtuel, sans risque de perte réelle, voilà la plus grande valeur du backtesting. La marche à suivre concrète pour accumuler les essais en test est expliquée dans « Qu'est-ce que Chart Replay ? Comment s'entraîner au trading d'actions sur des graphiques passés ».
Cause 3 : vos critères de décision ne sont pas mis en mots
La troisième cause concerne le contenu même de la décision. Pourquoi êtes-vous entré là ? Vous-même ne parvenez pas à le mettre en mots.
Vous entrez à l'instinct / vous n'avez pas de notes
« Ça semblait bien, alors je suis entré », « j'ai eu l'impression que la baisse s'arrêtait, alors j'ai acheté ». Si vos décisions en test reposent sur l'instinct, elles ne sont pas reproductibles. Car l'instinct fluctue selon l'humeur du jour et l'apparence de l'écran.
Pour rendre une décision reproductible, il faut mettre en mots les conditions d'entrée, les critères de stop loss et les repères de prise de bénéfice. Si c'est mis en mots, vous pourrez agir de la même manière la prochaine fois que la même condition se présentera. Sinon, votre décision sera différente à chaque fois.
Dans ENTRIQ, vous pouvez attribuer des Strategy Tags à chaque trade et consigner par écrit dans une note de trade « pourquoi vous êtes entré / ce que vous ressentiez alors ». La méthode pour mettre en mots et enregistrer vos décisions est traitée en détail dans « Comment tenir un journal de trading|poursuivre l'analyse avec les Strategy Tags ».
Cause 4 : vous n'analysez pas vos résultats
La quatrième cause fait qu'on arrête le test à une seule fois. Vous ne compilez pas vos résultats pour les analyser, et la boucle test → enregistrement → analyse → amélioration → nouveau test ne tourne pas.
Vous répétez les mêmes erreurs
Si vous bouclez chaque test isolément sans le revoir, vos travers ne se révèlent pas. Des tendances comme « prendre position sur un rebond et finir en stop loss » ou « prendre ses bénéfices trop tôt dès que le gain apparaît » ne se voient pas en une ou deux fois. Ce n'est qu'en examinant les chiffres à travers les trades portant le même tag qu'elles émergent. Puis vous corrigez consciemment le travers repéré au test suivant. Ce n'est qu'une fois cette boucle bouclée que le test mène au progrès.
ENTRIQ compile automatiquement, pour chaque Strategy Tag, la répartition des trades gagnants/perdants, l'évolution des résultats, la durée de détention moyenne, la distribution des résultats, l'espérance de gain, le facteur de récupération, l'écart-type des résultats, la série maximale de gains/pertes, et plus encore. De plus, à partir des enregistrements et des notes accumulés, vous disposez aussi de l'AI Analysis, qui met en mots les tendances observées. Enregistrer les prises de conscience obtenues au test, cerner ses travers grâce à l'analyse, puis les essayer au test suivant — les outils pour faire tourner ce cycle d'amélioration sont réunis. L'AI Analysis présente une mise en ordre fondée sur l'observation de données passées ; elle ne fournit ni prévision des mouvements de prix futurs ni recommandation d'achat ou de vente.
La manière de décrypter les enregistrements est traitée dans « Analyser ses trades avec l'AI Analysis|organiser ses tendances à partir des chiffres et des notes », et la logique par laquelle l'expérience du test devient le socle de la décision dans « Pourquoi le backtesting donne confiance|décider selon des critères sans paniquer en cas de perte latente ».
Le point commun des quatre causes, c'est l'angle « pouvez-vous reproduire la même décision » plutôt que « avez-vous gagné ». Chacune se rejoint sur un même point : elle brise la reproductibilité.
En résumé des 4 causes
Plus le nombre de tests augmente, plus la dispersion des décisions diminue. Le graphique ci-dessous illustre cette relation de manière conceptuelle.
Les quatre causes qui brisent la reproductibilité ne relèvent pas d'un « problème d'état d'esprit », mais de l'environnement et de la procédure. C'est pourquoi, en réglant l'environnement et la procédure, on peut s'améliorer.
| Cause | Qu'est-ce qui décale | Direction à régler (solution avec ENTRIQ) |
|---|---|---|
| 1. Le graphique que vous voyiez était différent | Bougie en formation et unité de temps de l'unité supérieure | Tester avec la même apparence qu'en trading réel grâce au forming bar method |
| 2. Vous n'avez pas vu la même configuration assez de fois | Nombre de répétitions | Répéter la même configuration autant de fois qu'on veut avec un capital virtuel, sans risque de perte réelle |
| 3. Vos critères de décision ne sont pas mis en mots | Justification de l'entrée et du stop loss | Consigner par écrit avec les Strategy Tags et des notes |
| 4. Vous n'analysez pas vos résultats | La boucle test → enregistrement → analyse → amélioration | Compiler automatiquement par tag, organiser avec l'AI Analysis, puis essayer ensuite |
Votre backtesting est-il reproductible (checklist)
- Pendant le test, l'unité de temps supérieure évoluait-elle « en formation » comme en trading réel ?
- Avez-vous répété la même configuration non pas 3 fois, mais des dizaines à des centaines de fois ?
- Pouvez-vous expliquer avec des mots les conditions d'entrée et de stop loss ?
- La boucle test → enregistrement → analyse → amélioration a-t-elle bouclé un tour ?
S'il y a ne serait-ce qu'un « non », c'est là que se trouve le point qui brise la reproductibilité.
La différence entre un backtesting reproductible et un backtesting non reproductible
En organisant les quatre causes comme des différences dans la façon de tester, l'écart entre un test reproductible et un test non reproductible devient clair.
| Test difficilement reproductible | Test facilement reproductible |
|---|---|
| Entrer à l'instinct | Mettre les conditions en mots |
| Essayer seulement quelques fois | Répéter la même configuration |
| Ne pas enregistrer | Consigner avec les Strategy Tags et des notes |
| Laisser en l'état | Analyser puis essayer ensuite |
Plus vous vous rapprochez de l'état de droite, plus le test devient reproductible en trading réel. La différence ne tient pas à la supériorité d'un outil, mais à la procédure de test elle-même.
Questions fréquentes (FAQ)
Q. Un backtesting est-il bon dès lors qu'il est globalement bénéficiaire ? A. Le fait d'avoir gagné ou non n'est qu'un résultat parmi d'autres. Ce qui compte, c'est de pouvoir reproduire cette décision en trading réel. Un test dont le profit est venu par hasard n'est pas reproductible. Prenez pour critère le fait que la procédure de décision soit mise en mots et que vous puissiez agir de la même manière à chaque fois.
Q. Combien de fois faut-il tester pour que ce soit suffisant ? A. Il n'y a pas de réponse claire, mais 3 fois et 300 fois, c'est totalement différent. Pour parvenir à réagir avant de réfléchir, il faut voir la même configuration de façon répétée jusqu'à l'assimiler. Avec un backtesting sur capital virtuel, sans risque de perte réelle, vous accumulez en peu de temps un nombre de fois qui prendrait des années en trading réel.
Q. L'enregistrement est-il indispensable ? A. Si vous recherchez la reproductibilité, oui. Si la raison de votre entrée n'est pas mise en mots, vous ne pourrez pas prendre la même décision la prochaine fois que la même condition se présentera. En mettant vos décisions en mots avec les Strategy Tags et des notes, vous pourrez aussi repérer vos travers par la suite.
Q. Pourquoi, alors que le backtesting était bénéficiaire, n'arrive-t-on pas à prendre la même décision en trading réel ? A. Plusieurs causes structurelles sont envisageables : l'écran vu en test diffère de l'écran réel (bougie en formation de l'unité de temps supérieure), le manque d'expérience de la même configuration, des critères de décision non mis en mots, l'absence d'analyse des résultats. Aucune ne relève du mental : ce sont des problèmes que l'on peut améliorer en réglant l'environnement et la procédure.
Q. Peut-on aussi faire tout cela avec TradingView ? A. TradingView est une plateforme de référence, solide pour la surveillance, le dessin et le partage d'idées. En revanche, pour un test répété sérieux, la reproduction de la bougie en formation des unités de temps supérieures et l'accumulation des résultats de test, un outil spécialisé dans le backtesting est plus adapté. L'« approche à deux outils », qui répartit les rôles en combinant les deux, est expliquée dans « 5 situations où le bar replay de TradingView montre ses limites, et comment y remédier ».
Si le backtesting n'est pas reproductible, ce n'est pas une faiblesse mentale mais un problème de structure. ① Le graphique que vous voyiez était différent, ② vous n'avez pas vu la même configuration assez de fois, ③ vos critères de décision ne sont pas mis en mots, ④ vous n'analysez pas vos résultats — en réglant ces quatre points, le test devient reproductible en trading réel.
La question à se poser n'est pas « avez-vous gagné » mais « est-ce reproductible ». Rien qu'en adoptant cet angle, la qualité de vos tests change.
ENTRIQ est un outil de pratique et de backtesting d'actions pour les traders particuliers, qui intègre Chart Replay, journal de trading et AI Analysis. Si vous souhaitez faire du test reproductible une habitude, essayez concrètement la profondeur du test et la facilité de répétition avec l'essai gratuit de 14 jours.
Ce service n'est pas une activité de conseil en investissement. Les informations fournies sont des informations de référence fondées sur des données passées. Les décisions d'investissement relèvent de votre propre responsabilité. Les valeurs des graphiques de l'article sont des échantillons destinés à illustrer des concepts ; elles n'indiquent ni la performance d'une méthode particulière ni des gains futurs.
Reproduce this validation yourself
With ENTRIQ's chart replay, you can trade through past charts using the same rules.
Start 14-day free trialValidate your method on past charts
The same validation in this article can be reproduced with your own method. On past charts, do the classics really work?
- ✓ Replay past charts
- ✓ AI feedback on your trades
- ✓ Validate methods with statistics