Define el indicador y los datos de entrada del backtest
Un indicador Forex es un cálculo basado en reglas que convierte datos de mercado (por ejemplo, precio o volumen) en una o más salidas, como un número o una condición. El backtesting evalúa cómo se habría comportado un proceso de decisión basado en indicadores con datos pasados.
Un backtest responsable comienza por definir exactamente qué se está probando:
- la fórmula del indicador y los valores de sus parámetros
- la regla de decisión (qué salida desencadena una acción, o cómo se utilizaría)
- el marco temporal y el método de muestreo (con qué frecuencia se calculan las entradas)
- los campos del conjunto de datos y sus unidades (por ejemplo, precio medio vs. bid/ask, marcas de tiempo, velas faltantes)
Si cambias cualquier supuesto—como usar un tipo de precio diferente o una alineación de velas distinta—los resultados pueden variar. Declara estas elecciones explícitamente antes de calcular cualquier cosa.
Separa la mecánica estable de las condiciones variables
Los indicadores se ejecutan sobre datos, pero los resultados reales del trading dependen de condiciones variables como los costos de transacción, la liquidez y el momento de ejecución. Para mantener el backtest interpretable, separa la mecánica estable de los factores variables:
- Mecánica estable: matemática del indicador, lógica de la regla de decisión, reglas de manejo de datos.
- Factores variables: efectos del spread/bid-ask, comisiones, deslizamiento, momento de llenado de la orden y restricciones operativas.
Un enfoque responsable modela estos factores variables con supuestos explícitos. Por ejemplo, si tu regla de decisión asume que puedes entrar a un cierto precio, define si ese precio es el medio, el bid, el ask o la apertura de la siguiente vela. Luego incluye un modelo de costos que refleje cómo los spreads y el deslizamiento podrían afectar el momento de entrada y salida.
Controla el sesgo: evita la retrospectiva, el sobreajuste y la fuga de datos
Los backtests a menudo fallan cuando, sin querer, “aprenden del período de prueba”. Los modos de fallo comunes incluyen:
- Sesgo de retrospectiva (look-ahead bias): usar información no disponible en el momento de la decisión.
- Sesgo de supervivencia o de selección: elegir solo las historias que “funcionaron” y descartar otras.
- Sobreajuste (overfitting): ajustar los parámetros tan estrechamente a un período que el rendimiento colapsa en otros.
- Fuga de datos (data leakage): características que incorporan valores futuros (por ejemplo, ventanas móviles desalineadas).
Para reducir estos sesgos, utiliza una separación estricta entre desarrollo y evaluación. Dos métodos prácticos son:
- Pruebas fuera de muestra (out-of-sample): mantén una ventana temporal final intacta hasta el final.
- Pruebas walk-forward: ajusta o selecciona repetidamente sobre una ventana de entrenamiento móvil y luego evalúa en el siguiente segmento.
También limita los grados de libertad. Si pruebas muchas combinaciones de parámetros e indicadores, los resultados pueden parecer sólidos por casualidad. Aplica criterios de selección consistentes y documéntalos.
Evidencia y ejemplo: qué calcular y cómo interpretar
Un backtest simple y centrado en la responsabilidad rastrea el rendimiento a través de múltiples métricas en lugar de un solo número. Considera calcular:
- el promedio y la distribución de los retornos por ventana de decisión
- los drawdowns y la frecuencia de resultados adversos
- la sensibilidad al modelo de costos (cómo cambian los resultados si aumentas el deslizamiento supuesto)
Para cualquier ejemplo que calcules, declara supuestos como:
- qué serie de precios utiliza el indicador
- el mapeo del precio de ejecución desde el momento de la decisión hasta el momento de la operación
- el modelo de costos utilizado para cada entrada/salida
La interpretación debe reflejar la incertidumbre. Incluso un backtest que parece fluido puede ser frágil si los resultados dependen en gran medida de un supuesto de costos estrecho o de un pequeño conjunto de períodos.
Limitaciones materiales y modos de fallo esperables
Las relaciones históricas no garantizan resultados futuros. Incluso cuando los sesgos están controlados, los indicadores Forex pueden fallar debido a cambios estructurales y a la evolución de la microestructura del mercado.
Las limitaciones materiales incluyen:
- Cambios de régimen: la volatilidad, las tendencias y las estructuras de correlación pueden cambiar.
- Realidad de la ejecución: el deslizamiento y la dinámica del spread pueden diferir de tu modelo.
- Inestabilidad de parámetros: pequeños cambios en la alineación de datos o en los parámetros pueden alterar los resultados.
- Sobreoptimización: las pruebas repetidas sin una separación estricta de evaluación inflan el rendimiento aparente.
Una mentalidad responsable trata los resultados del backtest como evidencia sobre la configuración de la prueba, no como prueba del rendimiento futuro.
Verificación y siguientes preguntas
Para verificar de forma independiente las afirmaciones sobre un indicador, deberías poder reproducir el backtest bajo los supuestos documentados. Una lista de verificación de verificación sólida incluye:
- ¿Puedes reproducir exactamente las salidas del indicador a partir de las entradas definidas?
- ¿Tienes un mapeo claro desde el momento de decisión del indicador hasta el precio de ejecución?
- ¿La evaluación se mantiene similar en los períodos fuera de muestra?
- ¿Qué tan sensibles son los resultados a costos más altos de lo supuesto y a diferentes alineaciones temporales?
Si no puedes responder estas preguntas con claridad, es probable que el backtest esté midiendo artefactos del manejo de datos, fugas o una subestimación de costos.