Gauntlet: el filtro GO / NO-GO / CONDICIONAL de un backtest
El bloque Gauntlet aparece bajo el resultado de cada backtest automático. Vuelve a ejecutar toda la cuadrícula de parámetros sobre el período completo, calcula el PSR, el DSR, un p-valor de permutación, el PBO y una distribución de drawdowns, y después aplica ocho criterios para responder a «¿este edge es real?» con GO, NO-GO o CONDICIONAL.
Senzoukria · Documentación · Actualizado en septiembre de 2026
Dónde encontrarlo
- Dónde
- Replay → Backtest automático → resultado → «Gauntlet — ¿este edge es real?»
- Veredictos
- GO (todos los criterios pasan), NO-GO (falla algún criterio eliminatorio), CONDICIONAL (solo fallan criterios orientativos)
- Coste adicional
- Un backtest de período completo por configuración de la cuadrícula, anunciado como «gauntlet · cuadrícula de periodo completo» y después «gauntlet · permutaciones»
- Día de sesión
- Día de futuros que cambia a las 17:00 America/Chicago, igual que el motor de prop firm
Qué hace
Después de una ejecución o de un walk-forward, runGauntlet toma la ruta de operaciones elegida (las operaciones fuera de muestra concatenadas del walk-forward, o las operaciones de una ejecución simple) y la cuadrícula que probó el barrido. Vuelve a ejecutar cada configuración sobre todas las barras para construir una matriz de P&L día de sesión × configuración, y después juzga tres series: el P&L diario de la ruta elegida para el PSR y el DSR, el P&L por operación para la prueba de permutación y la distribución de drawdowns, y la matriz para el PBO.
El veredicto en sí es una función pura (buildVerdict). Cada criterio registra su valor, su umbral, si es eliminatorio y un detalle legible, de modo que el bloque puede decir por qué, criterio a criterio, y no solo «NO-GO». Los criterios que necesitan una entrada de la que el software no dispone se marcan como «no evaluado» y no cuentan ni a favor ni en contra.
El bloque muestra el PSR, el DSR (verde por encima de 0,95), el p-valor (verde por debajo de 0,05), el PBO (verde por debajo de 0,5, «—» con una sola configuración), las configuraciones probadas y «Drawdown: el 95 % de los ordenamientos lo hacen mejor». Bajo los criterios, los gráficos del Gauntlet añaden los múltiplos de R, las curvas dentro y fuera de muestra, un Sharpe móvil sobre 20 sesiones, nubes de puntos de excursión adversa y favorable, los tramos bajo el agua y la estabilidad de parámetros.
Criterios
| Criterio | Umbral | Peso |
|---|---|---|
| La cuenta sobrevive a toda la ejecución | verdadero — nunca toca el drawdown | Eliminatorio; no evaluado sin un conjunto de reglas guardado |
| Walk-forward: suficientes ventanas, la mayoría rentables fuera de muestra | ≥ 3 ventanas y ≥ 70 % de ventanas OOS rentables | Orientativo; no evaluado en una ejecución simple |
| Prueba de permutación: edge distinguible del azar | p-valor < 0,05 | Eliminatorio |
| Sharpe deflactado: sobrevive al número de pruebas | DSR > 0,95 | Eliminatorio |
| Probabilidad de sobreajuste del backtest | PBO < 0,5 | Orientativo; no evaluado con una sola configuración |
| Drawdown máximo dentro del límite de la cuenta | |DD máx.| < drawdown de evaluación del conjunto de reglas elegido | Orientativo; no evaluado sin un límite |
| Sobrevive a los períodos rojos | verdadero | Eliminatorio cuando se evalúa; actualmente no evaluado |
| Ciclo de prop firm: lock alcanzado, inactividad respetada | sobrevive, lock alcanzado, sin fallo por límite de tiempo | Orientativo; se evalúa en cuanto se elige un conjunto de reglas |
Cómo usarlo
Lanza un walk-forward con un barrido en lugar de un backtest único: sin cuadrícula, N = 1, el DSR se reduce a un PSR contra cero, el PBO no se puede calcular y la estabilidad de parámetros no tiene nada con qué compararse. El veredicto es entonces honesto, pero pobre.
Elige un conjunto de reglas de prop firm guardado en la tarjeta «¿Debo comprar esta evaluación?» que está junto al Gauntlet. El veredicto se vuelve a calcular de inmediato con el límite de drawdown, la supervivencia de la cuenta y el ciclo prop de ese conjunto, sin lanzar otro backtest. Los siguientes pasos bajo un GO son fijos: comparar el P&L con un segundo motor sobre los mismos datos, dos semanas de simulación antes de cualquier cuenta fondeada, y un plan de corte por escrito antes de armar el autopiloto.
Límites y trampas
- Las estimaciones de permutación y de drawdown usan 10.000 cambios de signo o barajados de orden con una semilla fija; los p-valores son estimaciones con un error típico cercano a 0,005.
- El PBO necesita al menos 8 días de sesión en la matriz y al menos dos configuraciones; el número de particiones es 16 por defecto y se reduce al número de días cuando hay menos.
- Un GO es una afirmación sobre la muestra y la cuadrícula que le has dado. No dice nada sobre la ejecución en directo, el coste de los datos o las ejecuciones de un bróker, y no es una promesa de resultados.
Páginas relacionadas
- Pruebas de sobreajuste
- Barrido de parámetros
- ¿Debo comprar esta evaluación?
- Guía de backtesting de futuros
- Trading cuantitativo para principiantes
Esta página en otros idiomas
Preguntas frecuentes
- ¿Por qué mi resultado dice CONDICIONAL en lugar de GO?
- Ningún criterio eliminatorio ha fallado, pero sí al menos uno orientativo: menos de tres ventanas de walk-forward, menos del 70 % de ventanas rentables, un PBO igual o superior a 0,5, o un drawdown por encima del límite de la cuenta elegida. Cada criterio orientativo fallado se lista como una salvedad con su valor medido.
- ¿Qué configuración juzga el Gauntlet en cuanto a estabilidad?
- La que el walk-forward eligió más veces entre los pliegues, desempatando con el último pliegue; sin walk-forward es la configuración base. El gráfico de estabilidad la compara con las vecinas a un paso en un eje y etiqueta la superficie como meseta, pendiente o pico.
- ¿El Gauntlet necesita un conjunto de reglas de prop firm?
- No. Sin él, la supervivencia de la cuenta, el drawdown máximo y el ciclo prop se muestran como «no evaluado» y no influyen en el veredicto. Añadir un conjunto de reglas hace que cuenten.