Gauntlet : le filtre GO / NO-GO / CONDITIONNEL d'un backtest

Le bloc Gauntlet apparaît sous chaque résultat de backtest automatique. Il rejoue toute la grille de paramètres sur la période entière, calcule le PSR, le DSR, une p-value de permutation, le PBO et une distribution de drawdown, puis applique huit critères pour répondre à « cet edge est-il réel ? » par GO, NO-GO ou CONDITIONNEL.

Senzoukria · Documentation · Mis à jour en septembre 2026


Où le trouver

Replay → Backtest automatique → résultat → « Gauntlet — cet edge est-il réel ? »
Verdicts
GO (tous les critères passent), NO-GO (un critère éliminatoire échoue), CONDITIONNEL (seuls des critères indicatifs échouent)
Coût supplémentaire
Un backtest sur la période entière par configuration de la grille, annoncé « gauntlet · grille période entière », puis « gauntlet · permutations »
Jour de séance
Journée futures qui bascule à 17:00 America/Chicago, comme le moteur prop firm

Ce que ça fait

Après une exécution ou un walk-forward, runGauntlet prend le chemin de transactions retenu (les transactions hors échantillon concaténées du walk-forward, ou les transactions d'une exécution simple) et la grille essayée par le balayage. Il rejoue chaque configuration sur toutes les barres pour bâtir une matrice de P&L jour de séance × configuration, puis juge trois séries : le P&L quotidien du chemin retenu pour le PSR et le DSR, le P&L par trade pour le test de permutation et la distribution de drawdown, et la matrice pour le PBO.

Le verdict lui-même est une fonction pure (buildVerdict). Chaque critère enregistre sa valeur, son seuil, son caractère éliminatoire ou non, et un détail lisible, pour que le bloc puisse dire pourquoi, critère par critère, et pas seulement « NO-GO ». Les critères qui demandent une donnée dont le logiciel ne dispose pas sont marqués « non évalué » et ne comptent ni pour ni contre.

Le bloc affiche le PSR, le DSR (vert au-dessus de 0,95), la p-value (verte en dessous de 0,05), le PBO (vert en dessous de 0,5, « — » avec une seule configuration), les configurations essayées, et « Drawdown, 95 % des ordonnancements font mieux ». Sous les critères, les graphiques du Gauntlet ajoutent les multiples de R, les courbes dans l'échantillon contre hors échantillon, un Sharpe glissant sur 20 séances, les nuages d'excursion adverse et favorable, les périodes sous l'eau et la stabilité des paramètres.

Critères

Les huit critères de buildVerdict, dans l'ordre d'évaluation
CritèreSeuilPoids
Le compte survit à toute l'exécutionvrai — ne touche jamais le drawdownÉliminatoire ; non évalué sans jeu de règles enregistré
Walk-forward : assez de fenêtres, la plupart profitables hors échantillon≥ 3 fenêtres et ≥ 70 % des fenêtres hors échantillon profitablesIndicatif ; non évalué sur une exécution simple
Test de permutation : edge distinguable du hasardp-value < 0,05Éliminatoire
Sharpe dégonflé : survit au nombre d'essaisDSR > 0,95Éliminatoire
Probabilité de sur-ajustement du backtestPBO < 0,5Indicatif ; non évalué avec une seule configuration
Drawdown maximal dans la limite du compte|DD max| < drawdown d'évaluation du jeu de règles retenuIndicatif ; non évalué sans limite
Survit aux périodes rougesvraiÉliminatoire quand il est évalué ; actuellement non évalué
Cycle prop firm : lock atteint, inactivité respectéesurvit, lock atteint, aucun échec sur la limite de tempsIndicatif ; évalué dès qu'un jeu de règles est choisi

Comment s'en servir

Lancez un walk-forward avec un balayage plutôt qu'un backtest unique : sans grille, N = 1, le DSR se réduit à un PSR contre zéro, le PBO ne peut pas être calculé et la stabilité des paramètres n'a rien à comparer. Le verdict est alors honnête, mais maigre.

Choisissez un jeu de règles prop firm enregistré dans la carte « Dois-je acheter cette évaluation ? » placée à côté du Gauntlet. Le verdict est rejoué immédiatement avec la limite de drawdown, la survie du compte et le cycle prop de ce jeu de règles, sans relancer de backtest. Les étapes suivantes sous un GO sont fixées : comparer le P&L avec un second moteur sur les mêmes données, deux semaines de simulation avant tout compte financé, et un plan d'arrêt écrit avant d'armer l'autopilote.

Limites et pièges

  • Les estimations de permutation et de drawdown utilisent 10 000 inversions de signe ou mélanges d'ordre avec une graine fixe ; les p-values sont des estimations dont l'erreur type avoisine 0,005.
  • Le PBO demande au moins 8 jours de séance dans la matrice et au moins deux configurations ; le nombre de découpages vaut 16 par défaut et est ramené au nombre de jours quand celui-ci est plus court.
  • Un GO est une affirmation sur l'échantillon et la grille que vous lui avez donnés. Il ne dit rien de l'exécution en direct, des coûts de données ou des remplissages d'un broker, et ce n'est pas une promesse de résultats.

Cette page dans d’autres langues

Questions fréquentes

Pourquoi mon résultat indique-t-il CONDITIONNEL plutôt que GO ?
Aucun critère éliminatoire n'a échoué, mais au moins un critère indicatif oui : moins de trois fenêtres de walk-forward, moins de 70 % de fenêtres profitables, un PBO à 0,5 ou au-dessus, ou un drawdown au-delà de la limite du compte retenu. Chaque critère indicatif en échec est listé comme une réserve, avec sa valeur mesurée.
Quelle configuration le Gauntlet juge-t-il pour la stabilité ?
Celle que le walk-forward a retenue le plus souvent sur l'ensemble des plis, le dernier pli départageant les égalités ; sans walk-forward, c'est la configuration de base. Le graphique de stabilité la compare à ses voisines situées à un pas sur un axe et qualifie la surface de plateau, de pente ou de pic.
Le Gauntlet a-t-il besoin d'un jeu de règles prop firm ?
Non. Sans jeu de règles, la survie du compte, le drawdown maximal et le cycle prop sont affichés « non évalué » et n'influencent pas le verdict. En ajouter un les fait compter.