p-value
Une p-value est la probabilité d'observer un résultat au moins aussi extrême que celui mesuré, en supposant l'hypothèse nulle vraie. Dans le test de stratégies, l'hypothèse nulle est d'ordinaire « la règle n'a pas d'edge », et la p-value sort d'une procédure de permutation ou de bootstrap sur les trades enregistrés.
Senzoukria · Glossaire · Mis à jour en septembre 2026
Ce que le chiffre signifie
Fixez une hypothèse nulle, par exemple que les trades de la stratégie sont indiscernables de tirages aléatoires de même distribution. Calculez une statistique sur les trades réels : résultat net, Sharpe par trade, espérance. Déterminez ensuite à quelle fréquence cette statistique serait au moins aussi grande si l'hypothèse nulle était vraie. Cette fréquence est la p-value.
Dans un test de permutation, la fréquence se compte directement : réarrangez les données de nombreuses fois, recalculez la statistique et comptez les réarrangements qui égalent ou dépassent le résultat réel. Aucune formule de distribution n'est requise, ce qui compte pour des résultats de trades rarement normaux.
Ce qu'elle ne signifie pas
- Ce n'est pas la probabilité que l'hypothèse nulle soit vraie. Cela exigerait un a priori sur cette hypothèse, que le test n'utilise pas.
- Ce n'est pas la probabilité que la stratégie continue de marcher. Elle décrit l'échantillon, pas le futur.
- Ce n'est pas une mesure de la taille de l'effet. Un edge minuscule sur un énorme échantillon peut produire une p-value faible ; un edge important sur dix trades, non.
- Elle n'est pas corrigée de la sélection. Retenez la meilleure de nombreuses configurations et sa p-value est optimiste ; le Sharpe déflaté et la PBO traitent ce point.
Dans Senzoukria
Le panneau de backtest du desktop affiche une p-value dans son gauntlet go/no-go, calculée par la phase de test de permutation. Le critère associé est formulé « Test de permutation : edge distinguable du hasard ». La p-value se trouve à côté du PSR, du DSR, de la PBO et du nombre de configurations essayées : le lecteur voit d'un coup si l'échantillon survit aussi à la correction pour la sélection.
Le panneau de performance de Replay ne publie pas de p-value ; il signale les petits échantillons avec la note que les ratios sont affichés parce qu'ils sont exacts, pas parce qu'ils sont significatifs. Les tests de significativité relèvent du panneau de backtest.
Erreurs fréquentes
- S'arrêter à un seuil fixe. Un seuil conventionnel est une convention, et un faux positif se paie sur un compte réel, pas dans un article.
- Tester de façon répétée sur les mêmes données et garder la plus petite p-value. Chaque test est un essai.
- Publier une p-value sans la statistique et la taille d'échantillon qui l'ont produite.
- Lire une p-value élevée comme la preuve d'une absence d'edge. Elle dit seulement que cet échantillon n'en a pas montré.
Voir aussi
- Le trading quantitatif pour débuter
- Test de permutation
- Sharpe déflaté
- Guide du backtesting sur futures
Cette page dans d’autres langues
Questions fréquentes
- Une p-value faible suffit-elle à trader une stratégie ?
- Non. Elle dit que le résultat observé était rare sous l'hypothèse sans edge, sur cet échantillon et sous ces hypothèses. Elle ne tient compte ni des coûts non modélisés, ni du nombre de configurations essayées, ni du drawdown face aux règles du compte, ni d'un changement de régime. C'est pour cette raison que le gauntlet du desktop la liste comme un critère parmi plusieurs.
- Pourquoi la p-value change-t-elle quand je relance le gauntlet ?
- La phase de permutation tire des réarrangements aléatoires : deux runs sur les mêmes données produisent donc des comptes légèrement différents. La variation se resserre à mesure que le nombre de permutations augmente. Si la p-value saute d'un côté à l'autre d'une frontière de décision entre deux runs, l'échantillon vous dit que le résultat est marginal.