El proceso
Cuatro pasos hasta una decisión, y todo lo que hay debajo.
Una validación solo vale algo si sus reglas se fijaron antes de que nadie conociera la respuesta. Aquí están los cuatro pasos que compras, los veinte que contienen y las siete etapas contractuales sobre las que se ejecutan.
Cómo funciona una validación
Cuatro pasos, desde el material que ya tienes hasta una decisión sobre la que puedes actuar.
Define
Envía código, Pine Script, operaciones o reglas escritas. Strateva convierte el material en un scope exacto que tú confirmas.
Ejecuta
Congelamos las reglas, los datos, los costes y el benchmark. La estrategia se ejecuta en un entorno aislado.
Verifica
El motor reproduce las métricas y analiza robustez, dependencia temporal, costes, benchmark y trayectorias alternativas.
Decide
Recibes las evidencias, las limitaciones y un resultado que indica cuál es el siguiente paso.
Cada validación termina en uno de tres resultados
- Preparada para shadowing
- Revisión necesaria
- Evidencia insuficiente
La IA puede interpretar y preparar. Las métricas y el veredicto los produce un motor determinista.
Los veinte pasos, completos
Los cuatro pasos anteriores son lo que es una validación. Estos veinte son lo que hace. Se publican para que el resultado se pueda discutir, no porque haya que leerlos antes de comprar.
Material recibido
Tu código, tu Pine Script, tu lista de operaciones o tus reglas escritas llegan tal como están. No hay que ordenar nada antes: el estado en el que viene es justo lo que indica cuánta reconstrucción necesita el trabajo.
Interpretación asistida
Las reglas escritas en prosa se leen y se convierten en un borrador de especificación. Este es el único paso en el que interviene un modelo, y produce una propuesta, nunca un número.
Creación del Validation Scope
La afirmación que se pone a prueba, el activo, el timeframe, el periodo, los costes y el benchmark quedan escritos en un único documento exacto.
Tú lo confirmas
No se ejecuta nada hasta que aceptas que la especificación es tu estrategia. Es el último momento en el que se puede elegir cualquiera de esas cosas.
Datos preparados y congelados
La serie se monta, se revisa y se fija. A partir de aquí las entradas no se mueven, que es lo que hace que la respuesta sea repetible.
Estrategia normalizada
La estrategia se expresa en una forma que el motor puede ejecutar sin alterar lo que hace.
Ejecutor revisado
Lo que va a ejecutarse de verdad se lee antes de ejecutarse. El código generado o adaptado nunca se ejecuta sin revisar.
Ejecución aislada
La ejecución ocurre en un entorno limpio, sin acceso a nada fuera de las entradas congeladas, de forma que lo que se mide es la estrategia y no su entorno.
Traza de estrategia producida
Un registro de lo que hizo la estrategia, decisión a decisión, y no solo de lo que devolvió.
Traza de estrategia verificada
La traza se contrasta con la especificación: las posiciones tomadas son las posiciones que implican las reglas acordadas.
Núcleo cuantitativo
Las métricas se recalculan a partir de la ejecución y se reconcilian con lo que se declaró antes de ella.
Monte Carlo clásico
Caminos alternativos plausibles, para leer el drawdown y el tiempo bajo el agua como rangos y no como la única historia que ocurrió.
Permuted Monte Carlo
Los mismos retornos en otro orden, para separar una ventaja real de una secuencia afortunada.
Evidencia versionada
Cada cifra se guarda junto a lo que la produjo, de modo que un número se pueda rastrear en vez de creerlo.
Verificación independiente
La evidencia se contrasta con los criterios por una vía que no reutiliza el código que la produjo.
Criterios evaluados
Se aplica la regla de decisión congelada. Los criterios se fijaron antes de ejecutar, así que el resultado no se elige cuando ya se ve la respuesta.
Resultado técnico
El resultado interno, en el vocabulario propio del motor y con su nivel de detalle.
Proyección pública
Ese resultado se proyecta al contrato publicado: cuatro categorías, un estado, un motivo y un paso siguiente.
Revisión humana
Una persona lee la coherencia entre evidencia, categorías y conclusión, y si las limitaciones son lo bastante concretas como para actuar sobre ellas.
Entrega final
El informe, su anexo y el resultado te llegan juntos, con el alcance dentro del cual son válidos.
Los pasos se describen en términos públicos. Los umbrales, los identificadores internos, los comandos y la infraestructura se quedan donde corresponde. Varios de estos pasos implican que una persona lea algo; ninguno es totalmente automático, y esta página no dice lo contrario.
Con qué se hace
Tres cosas que casi nadie hace, y que son la diferencia entre una opinión y una comprobación.
Escáner de sesgos
Lee tu código y busca el futuro donde no debería estar.
Un analizador recorre la estructura de tu código, no su texto. Eso importa: los patrones por los que el futuro se cuela en el pasado casi nunca se escriben igual dos veces, y un buscador de texto se los pierde. Está construido asumiendo que nadie los escribe de forma evidente — resuelve alias, expresiones calculadas y variantes que se leen distinto pero hacen lo mismo.
Es un filtro, no un certificado. Un resultado limpio reduce el riesgo; no prueba que no haya sesgo.
Walk-forward anidado
Los parámetros se eligen sin ver jamás los datos con los que se juzgan.
Dos bucles. El interno prueba las configuraciones sobre datos que ya pasaron; el externo evalúa la elegida sobre datos que ese bucle nunca vio. Entre ambos hay un hueco purgado del tamaño del horizonte de la etiqueta, para que ninguna etiqueta de entrenamiento se resuelva dentro del periodo evaluado.
Verificado por perturbación exhaustiva: alterar cualquier dato futuro no cambia ni una sola decisión anterior.
Holdout prospectivo sellado
El criterio se congela antes de que exista la primera observación.
El calendario exacto, el benchmark, el modelo de costes y la regla de decisión se fijan y se sellan por hash antes de empezar. Cada observación se añade a un registro encadenado y firmado, en orden, sin poder editar lo anterior. El veredicto se calcula contra esa regla congelada, no contra una elegida después.
Es la única prueba que no admite reinterpretación a posteriori. También la más lenta: el tiempo tiene que pasar de verdad.
Caminos alternativos plausibles
Se generan caminos alternativos posibles conservando parte de la dependencia temporal observada en la serie original. Eso permite estimar cómo podrían variar el drawdown, el tiempo bajo el agua, las rachas perdedoras y el riesgo de ruina, en vez de leer un único camino histórico como si fuera el único disponible.
Cómo funciona el remuestreo
El remuestreo preserva la estructura local en lugar de barajar las observaciones de forma independiente, porque barajarlas independientemente destruye justo el agrupamiento que hace profundos los drawdowns.
El mismo resultado, en otro orden
Se conservan los retornos observados exactamente como son y se cambia el orden en el que llegan. Eso muestra cuánto del riesgo dependía de que la historia hubiera ocurrido en una secuencia especialmente favorable.
El retorno histórico puede quedarse igual mientras la experiencia del riesgo cambia por completo.
Qué mide esto y qué no
Permutar los mismos retornos sin reemplazo deja el resultado final intacto — el retorno total es idéntico en todas las permutaciones, por construcción. Así que esto no es una distribución del beneficio final, y no se presenta como tal. Lo que mide es todo lo que depende del orden:
- Drawdown máximo
- Duración del drawdown
- Tiempo bajo el agua
- Racha perdedora más larga
- Riesgo de ruina
Cómo se construye el veredicto
El resultado se deriva de evidencia estructurada y de reglas deterministas fijadas antes de ejecutar. No es un recuento de aprobados: cada pilar lleva su propia conclusión y su propia evidencia, y el informe dice cuál decidió el resultado. Una estrategia puede superar todas las comprobaciones estadísticas y aun así fallar en lo económico, y promediar eso en una sola nota escondería justo lo que merece la pena saber.
El shadowing no es una autorización para operar con capital real, y ningún resultado garantiza rentabilidad futura.
Cada encargo termina en uno de cuatro resultados
- Preparada para shadowing
- Revisión necesaria
- Evidencia insuficiente
- Revisión pendiente
- Preparada para shadowing: no se encontró ningún motivo para descartar la estrategia una vez comprobados el benchmark, los costes y la estabilidad en el tiempo. Significa «pruébala primero en paralelo, sin capital». Nunca es una autorización para pasar a producción ni para operar con capital real.
- Ese resultado puede llevar limitaciones. Solo se admiten si son concretas, están escritas en el informe y no impiden esa fase de prueba en paralelo.
- Revisión necesaria: la estrategia no superó una de las comprobaciones obligatorias. El informe indica cuál, qué medía y qué tendría que cambiar.
- Evidencia insuficiente: nada falló de forma clara, pero el material no da para concluir. No es el mismo resultado que el anterior, y siempre se te dice cuál de los dos te ha tocado.
- Mientras la revisión de la evidencia sigue abierta, el encargo está en revisión pendiente y no se publica ningún resultado. Si la estrategia está lista para producción es una cuestión aparte, se informa por separado y no cambia el resultado.
Cuando una estrategia no sale adelante hay dos motivos distintos y siempre se te dice cuál te ha tocado: una comprobación concreta falló, o la evidencia disponible no permitió resolver la pregunta. «Revisión necesaria» y «evidencia insuficiente» no son el mismo resultado, y presentarlos como si lo fueran es la forma más rápida de que una validación deje de servir para nada.
Qué hace la IA y qué no
Qué hace
- Interpreta reglas escritas en prosa y las convierte en un borrador de especificación.
- Prepara el material para que el motor pueda ejecutarlo.
Qué no hace nunca
- Tú confirmas la interpretación antes de que se ejecute nada.
- La IA no calcula las métricas.
- La IA no calcula el veredicto.
- La IA no puede cambiar las reglas una vez visibles los resultados.
Las métricas y el resultado salen de un motor determinista. Esa separación es la razón por la que el veredicto significa algo.
Qué revisa una persona
Antes de entregar nada, una persona lee la evidencia detrás de cada comprobación, la coherencia entre los pilares y la conclusión, si las limitaciones son lo bastante concretas como para actuar sobre ellas, y si el informe responde a la pregunta que de verdad se hizo.
Las siete etapas
El orden es fijo. No se salta ninguna etapa y, una vez congelados los inputs, ninguna etapa anterior puede reabrirse sin empezar de nuevo.
Envía tu estrategia
Tú
Describes qué hace la estrategia y envías lo que tengas: una serie de retornos, un notebook, un repositorio o las reglas escritas. Nada tiene que estar ordenado todavía: el estado en el que llega es precisamente lo que indica cuánta reconstrucción necesita el trabajo.
Produce: tu material registrado tal como se envió
Confirma el alcance
Conjunto
Acordamos por escrito qué afirmación se pone a prueba, contra qué benchmark, en qué periodo, con qué supuestos de coste y qué contaría como un fallo. Es el último momento en que cualquiera de esas cosas puede elegirse.
Produce: un Validation Scope confirmado por ti
Congelamos los inputs
Strateva
El material acordado, los datos y la regla de decisión quedan fijados y con huella. A partir de aquí la pregunta está cerrada y lo único desconocido es la respuesta.
Produce: reglas, datos, costes y benchmark fijados y con huella
Ejecutamos en aislamiento
Strateva
La estrategia se ejecuta en un entorno limpio y aislado, sin acceso a nada que esté fuera de los inputs congelados, de modo que lo que se mide es la estrategia y no su entorno.
Produce: una ejecución completada en un entorno aislado
Validamos cuantitativamente
Strateva
Los resultados pasan por las comprobaciones acordadas en el alcance: la estructura causal, la evidencia estadística, la economía después de costes y la estabilidad de todo ello bajo estrés.
Produce: la evidencia medida detrás de cada comprobación
Revisamos la evidencia
Strateva
Cada comprobación se lee a mano contra la evidencia que la sostiene. Una cifra que no pueda trazarse hasta cómo se produjo no llega al informe.
Produce: esa evidencia leída y reconciliada por una persona
Recibes veredicto e informe
Strateva
Recibes un resultado, su motivo, qué tendría que cambiar y la evidencia sobre la que se apoya. El resultado se calcula contra la regla congelada en la tercera etapa, nunca contra una elegida cuando ya se veía el resultado.
Produce: el informe y el resultado
Quién hace qué
Qué aportas tú
- La estrategia, en la forma en que exista: retornos, código, un notebook o las reglas escritas.
- Qué crees que hace y qué resultado esperas que resista.
- Los datos, o información suficiente para poder reunir un conjunto equivalente.
- Todo lo que ya sepas que falla en ella. Las limitaciones declaradas no cuestan nada; las descubiertas cuestan un nivel de servicio.
Qué confirmas antes de que se ejecute nada
- La afirmación exacta que se pone a prueba, escrita en una frase.
- El benchmark contra el que se compara y por qué esa es la comparación justa.
- El periodo, el universo y los supuestos de coste.
- Qué contaría como un fallo, acordado mientras la respuesta sigue siendo desconocida.
- El alcance y el precio. Ninguno cambia después sin tu aprobación.
Qué hace Strateva
- Congela los inputs y les pone huella, para que la pregunta no pueda derivar hacia la respuesta.
- Reproduce el resultado en un entorno aislado, sin alterar en silencio la afirmación original.
- Lo cuestiona en los cuatro pilares, no solo en el que parece más débil.
- Lee a mano la evidencia que hay detrás de cada cifra antes de publicarla.
- Enuncia el resultado contra la regla congelada e indica cuál de los cuatro es.
Qué recibes
- Un resultado, en lenguaje claro, con el motivo por el que ha quedado ahí.
- Los cuatro pilares, argumentados por separado, para que una debilidad quede localizada en lugar de diluida en una media.
- Las limitaciones y los riesgos que no se resolvieron.
- Las condiciones bajo las cuales merecería la pena revalidar el resultado.
- El anexo de evidencia del que salen las cifras.
Por qué se congelan los inputs
Casi todos los backtests que fallan en producción fallaron de la misma manera: la regla se ajustó, de buena fe, después de ver el resultado. Un umbral que se mueve, un periodo que se recorta, un benchmark que se cambia por otro más amable. Cada cambio es defendible por separado y, juntos, garantizan una respuesta con buen aspecto.
Congelar los inputs convierte eso en imposible en lugar de en desaconsejable. La afirmación, los datos, los costes y la regla de decisión quedan fijados y con huella antes de ejecutar, de modo que el resultado se calcula contra una regla que existía antes de que nadie supiera qué diría.
Es también lo que hace el resultado repetible. Cualquiera que tenga los mismos inputs congelados obtiene la misma respuesta, y esa es la diferencia entre una validación y una opinión.
Qué no hace una validación
- No predice la rentabilidad futura. Informa de lo que se sostuvo bajo las comprobaciones acordadas, en el periodo examinado, y de nada más.
- No es asesoramiento de inversión ni una recomendación para asignar capital.
- «Preparada para shadowing» no autoriza a operar con dinero real. Significa que la estrategia puede ejecutarse sin capital, en paralelo, para observar su comportamiento en vivo.
- Un resultado limpio reduce el riesgo; no demuestra la ausencia de un defecto. Ningún conjunto finito de comprobaciones puede hacerlo.
- Si una estrategia está lista para producción es una pregunta distinta, se informa por separado y no cambia el resultado.
¿Tienes algo que necesite una revisión independiente?
Describe la estrategia, el backtest o el modelo. El alcance y el precio se confirman contigo antes de empezar cualquier trabajo.
No se ejecuta nada, ni se cobra nada, antes de que apruebes el alcance.
La información que envíes se utilizará para evaluar tu solicitud. Consulta la política de privacidad.
Strateva