Artículos

Hice un bot con IA en 30 minutos: cómo saber si el backtest es suerte

Un bot generado rápido también acumula intentos. Cuenta las variantes, compara el Sharpe con la calculadora y revisa el efecto de los costos.

Declarado · Los treinta minutos del título describen una situación ilustrativa, no un desarrollo cronometrado por Rigor. Un hilo viral muestra el mensaje enviado a un agente, el código y una curva ascendente. Lo que suele faltar es el recorrido entre esas imágenes: instrucciones descartadas, filtros añadidos y cambios de mercado después de mirar el resultado. Crear código rápido no crea evidencia nueva. Antes de interpretar la curva, hace falta reconstruir cuántas oportunidades tuvo el proceso de encontrar una coincidencia favorable en el mismo pasado.

Cuenta la búsqueda completa

Cada vez que el agente prueba una regla y recibe el resultado, esa información puede orientar el siguiente cambio. Cambiar el indicador, la salida, el horario o el activo pertenece a la búsqueda aunque el archivo final conserve el mismo nombre. También cuentan las versiones que no llegaron al hilo. El número de mensajes del chat no equivale al número de configuraciones: una instrucción puede lanzar muchas combinaciones, y una corrección de sintaxis puede no cambiar ninguna regla.

Conserva el registro del optimizador, las versiones y el criterio usado para elegir. Si falta parte del recorrido, declara esa ausencia. Un recuento parcial no debe presentarse como el total medido.

Compara contra una búsqueda sin habilidad

La calculadora pública recibe el Sharpe anual, la duración y el número de configuraciones. Compara el resultado declarado con el Sharpe esperado de la mejor variante de una búsqueda sin habilidad bajo sus supuestos. Esa referencia no describe una cuenta concreta. Tampoco es la probabilidad de que el bot funcione después. Resume cuánto puede elevar el máximo observado el simple hecho de seleccionar entre alternativas.

La tabla usa entradas declaradas y rendimientos diarios con colas normales. Mantiene el mismo Sharpe de entrada al cambiar duración e intentos. Las variantes parecidas no son independientes: conserva esa limitación al interpretar el cálculo, sin convertirla en permiso para borrar intentos.

Lee la tabla antes de celebrar la curva

La tabla cruza tamaños de búsqueda con duraciones del historial. Cada fila vuelve a llamar a la calculadora; ninguna celda procede de una captura viral. Al aumentar la búsqueda aumenta la referencia de suerte, mientras que ampliar el historial suele reducir su dispersión. Eso explica por qué una curva seleccionada después de muchas pruebas exige más contexto que una regla definida de antemano.

Los años no son intercambiables con las operaciones. Muchas entradas concentradas en el mismo episodio pueden aportar poca diversidad. Revisa la cobertura temporal, las pausas y los cambios de régimen, además del total de filas.

Somete los costos al doble

Declarado · La prueba a 2x es un escenario: duplica los supuestos de costos y compara el resultado con la ejecución base. Documenta comisión, spread, deslizamiento y financiación cuando correspondan. Evita descontar otra vez un costo que ya figure dentro de la serie neta. Si solo tienes rendimientos agregados y desconoces las operaciones o sus gastos, ese efecto queda No medido; no rellenes el vacío con una cifra cómoda.

Rigor revisa la sensibilidad a costos cuando el archivo aporta la información necesaria. Observa cuánto cambia la lectura y qué parte sigue sin medirse. Un escenario de costos no reproduce todas las condiciones de ejecución de una plataforma.

Sharpe esperado por suerte

Declarado · Supongamos 100 variantes independientes y 3 años de rendimientos diarios, con 252 periodos al año y un Sharpe anual declarado de 1.8. La calculadora sitúa el Sharpe esperado de la mejor variante sin habilidad en 1.47. Es una cuenta bajo supuestos de asimetría nula y colas normales, no una medición de una cartera.

Declarado · Entradas ilustrativas y resultados calculados; no son datos de un archivo.
IntentosAñosSharpe por suerte
Declarado · 10Declarado · 1Declarado · 1.58
Declarado · 10Declarado · 3Declarado · 0.91
Declarado · 10Declarado · 5Declarado · 0.71
Declarado · 100Declarado · 1Declarado · 2.54
Declarado · 100Declarado · 3Declarado · 1.47
Declarado · 100Declarado · 5Declarado · 1.14
Declarado · 1,000Declarado · 1Declarado · 3.27
Declarado · 1,000Declarado · 3Declarado · 1.89
Declarado · 1,000Declarado · 5Declarado · 1.46

Separa desarrollo y evaluación

Reserva un tramo que el agente no haya visto y define antes qué compararás. Si modificas la estrategia tras conocer ese resultado, el tramo ya influyó en el desarrollo. Guárdalo en el registro de búsqueda y explica el cambio. Repetir el ciclo hasta obtener una curva atractiva no recupera la independencia perdida.

Inspecciona además si los precios usados estaban disponibles al decidir, cómo se ajustaron los datos y si el universo conserva instrumentos desaparecidos. Un error de fechas puede dominar cualquier corrección estadística. Pide al agente que explique decisiones y supuestos; el tono seguro de su respuesta no sustituye una prueba reproducible.

Lleva el archivo a la lectura pública

El lector público enlazado permite empezar por cifras declaradas. La calculadora ayuda a explorar otros tamaños de búsqueda. Para revisar la evidencia del historial, conserva el archivo original y acompáñalo de los intentos conocidos, la frecuencia y los costos. Una imagen del saldo no contiene esa trazabilidad.

En el informe, Medido identifica lo calculado con los archivos, Declarado lo aportado por ti y No medido lo que no pudo evaluarse. El primer informe completo gratis usa el mismo acceso que los demás artículos. Su lectura puede señalar ausencias o debilidades del backtest; no decide por ti ni conecta el bot a una cuenta.

Preguntas frecuentes

¿La IA cambia cómo se interpreta el backtest?

Cambia la velocidad de exploración, pero siguen importando los datos disponibles al decidir, los costos y las variantes descartadas. Si el agente recibió resultados anteriores, registra ese recorrido. El archivo elegido por sí solo no revela toda la búsqueda.

Relacionado

Ponlo a prueba

La calculadora de suerte es gratis y no pide registro. Con tu cuenta, el primer informe completo también es gratis.