Estrategiastrategy-labbacktestingout-of-sampletransparencyvalidation

El Strategy Lab sale de beta. Al menos diez de sus treinta estrategias están por debajo de nuestro propio listón.

16 de agosto de 2026·8 min de lectura
El Strategy Lab sale de beta. Al menos diez de sus treinta estrategias están por debajo de nuestro propio listón.

Este es el número que una biblioteca de estrategias no debería publicar.

En el re-test de hoy (16 de agosto de 2026), al menos 10 de las 30 estrategias del Anny Strategy Lab no superan uno o más de los umbrales que exigimos para su publicación. Siguen en la página. Siguen siendo copiables. Los números que no pasan el corte se muestran en cada una.

El "al menos" de esa frase tiene mucho peso. El re-test diario recalcula seis de los siete filtros: trades, win rate, Sharpe, drawdown, degradación out-of-sample, Sharpe out-of-sample. El séptimo, el recuento de trades out-of-sample, se verifica en el momento de publicar una estrategia y no se almacena para comprobaciones posteriores. Así que 10 es un suelo, no un total exacto, y la dirección honesta en la que redondear es hacia arriba.

Ese número cambia cada día, en ambas direcciones. Hace dos días era 18. La página de estrategias muestra la cifra actual, y esa es la que manda, no esta.

Lo publicamos porque una biblioteca cuyos números solo mejoran es una biblioteca que no está re-testeando. Lo que está haciendo es reimprimir el día en que publicó.

Hoy el Lab sale de beta. Así funciona, filtro por filtro.

Lo que la búsqueda realmente descarta

En el último sweep registrado, ejecutado antes del 16 de agosto de 2026, el Lab realizó backtests de 9.385 combinaciones de parámetros. Veinticinco de ellas generaron suficientes trades para ser evaluadas frente al listón de calidad. Cuatro fueron publicadas.

Hay que ser precisos sobre lo que ocurrió con las otras 9.360: la gran mayoría nunca llegó a los treinta trades mínimos, así que no había nada que juzgar. Ese es un filtro mecánico, no un veredicto de que cada una de ellas habría perdido dinero. Ninguna se ejecutó jamás con capital real, y no estamos afirmando lo contrario.

Los sweeps se lanzan de forma deliberada, a mano, cuando decidimos ejecutar uno. No hay calendario ni promesa sobre con qué frecuencia crece la biblioteca. La parte diaria de este sistema es el re-test, no la búsqueda.

El listón

Para ser elegible para su publicación, un candidato debe superar los siete siguientes filtros:

FiltroUmbral
Trades cerrados en backtestal menos 30
Win rateal menos 40%
Ratio de Sharpeal menos 0,5
Drawdown máximono peor que 35%
Degradación out-of-sampleno peor que 50%
Sharpe out-of-sampleal menos 0,3
Trades out-of-sampleal menos 8

Cada cifra anterior se mide en trades que pagan costes. Cada lado de cada trade asume una comisión taker del 0,1% más slippage: 0,1% en majors, 0,3% en todo lo demás. Un viaje de ida y vuelta en una altcoin por tanto cede un 0,8% antes de poder mostrar beneficio. Los backtests que omiten esto son la razón por la que una estrategia con un 42% de win rate parece viable en un gráfico y no lo es en un exchange.

Se aplican además dos suelos adicionales: un Sharpe ratio probabilístico de al menos 0,6 medido en datos out-of-sample, y rentabilidad en al menos la mitad de los períodos walk-forward.

Una limitación honesta, ya que citamos un Sharpe probabilístico junto a un recuento de candidatos de cinco cifras: esa probabilidad no se ajusta a la baja por el número de combinaciones que testamos. Busca entre 9.385 candidatos y algunos superarán cualquier listón fijo por pura suerte. La muestra retenida que se describe más abajo es en la que nos apoyamos para detectar eso, no en el número del PSR. Corregir el listón por el tamaño de la búsqueda está en nuestra lista y aún no está implementado.

Superar todos los filtros hace a un candidato elegible. Es una prueba de entrada, realizada una sola vez, el día de la publicación. Lo que ocurre después está más abajo en esta página.

Qué significa "out-of-sample" aquí

El historial de cada estrategia se divide cronológicamente. El primer 80% se usa para encontrarla y ajustarla. La búsqueda de parámetros nunca lee el 20% final — ningún parámetro de ningún candidato se elige, puntúa ni clasifica usando esos datos. La estrategia superviviente se ejecuta entonces contra ese tramo intacto, y si se desmorona allí no se publica, por muy buenos que fueran los resultados en el primer 80%.

También dividimos el historial completo en cuatro períodos secuenciales y verificamos que la estrategia se mantuvo en todos ellos, en lugar de deber su resultado a un mes de suerte. Para ser exactos: los parámetros permanecen fijos en los cuatro períodos, así que lo que esto mide es consistencia. Reoptimizar dentro de cada ventana sería walk-forward optimisation, que es una afirmación diferente y más fuerte que la que estamos haciendo.

9.385 combinaciones fueron ajustadas en el primer 80%. Cuatro seguían en pie después del 20% final. Esa brecha es lo que una muestra retenida le cuesta a un candidato, y lo que saltarse ese paso nos habría permitido publicar.

Peak Fader en DOT: métricas in-sample arriba, validación out-of-sample abajo, incluyendo la cifra de degradación
Peak Fader en DOT: métricas in-sample arriba, validación out-of-sample abajo, incluyendo la cifra de degradación

Peak Fader en DOT, tal y como fue publicada. El bloque superior muestra lo que hizo la estrategia a lo largo de su historial completo. El bloque inferior es el 20% retenido que nunca vio durante el ajuste, incluyendo cuánto decayó. Ambos están en la página pública, uno al lado del otro.

Qué hay en la biblioteca hoy

A 16 de agosto de 2026: 30 estrategias, en 15 activos y 14 tipos de estrategia distintos. La más pequeña tiene 30 trades cerrados y la media tiene 45. Estos son trades simulados de backtest, no historial de trading en vivo.

Cada estrategia está en cola para un re-backtest con datos de mercado frescos a diario, y los números de su página se sustituyen por los que devuelva ese re-test. El resultado se publica incluso cuando es peor que el día en que publicamos, que es la razón por la que una estrategia publicada puede acabar mostrando un Sharpe out-of-sample negativo en público.

Aquí hay una, ahora mismo en el sitio:

Momentum Rider en SOL: Sharpe 0,23, Sharpe out-of-sample −1,49, degradación 100%
Momentum Rider en SOL: Sharpe 0,23, Sharpe out-of-sample −1,49, degradación 100%

Momentum Rider en SOL. Un Sharpe de 0,23 frente a nuestro suelo de 0,5, un Sharpe out-of-sample de −1,49, y la degradación anclada en el tope de +100. Está publicada, es copiable, y esos son los números que mostramos.

Dos cosas que entender sobre esto:

Una alerta no es una retirada. El re-test diario marca una estrategia que ha caído por debajo de un filtro. No la retira. Una estrategia que falla permanece en la biblioteca, aún copiable, con sus filtros fallidos mostrados. Retirarla es una decisión que alguien toma de forma deliberada. Trata una alerta como una advertencia sobre la que tienes que actuar, no como una limpieza que ya hicimos por ti.

La cifra de degradación tiene un tope. Expresamos la degradación respecto al backtest original como un porcentaje acotado en ±100, donde un número positivo significa que el tramo out-of-sample fue peor y un número negativo significa que fue mejor. Una estrategia que muestra +100 ha decaído al menos esa cantidad y posiblemente más. Nueve de las treinta están exactamente en un extremo de ese tope hoy: cuatro en +100, cinco en −100. Para esas nueve, la cifra mostrada subestima cuánto se han movido realmente.

Las reglas son privadas en todos los planes

Ves las métricas que te permiten juzgar una estrategia: historial completo de trades, curva de equity, win rate, drawdown, resultados out-of-sample, y en qué regímenes de mercado funcionó.

No ves los valores exactos de los parámetros. Ni en Free, ni en Pro, ni en Pro Max. La mayoría de los productos de esta categoría venden esos números en el nivel más alto; los nuestros se retienen en todos los niveles, que es la razón por la que esta sección termina sin un botón de upgrade.

Todas las interfaces del producto los retienen, incluyendo el chat y los enlaces compartidos. Si encuentras algún camino que los devuelva, dínoslo y lo cerraremos.

Puedes ejecutar una estrategia sin ellos. La ejecución es del lado del servidor: las reglas corren en nuestras máquinas y nunca se envían a tu navegador, tu configuración de bot ni tu cuenta en el exchange.

Qué puedes hacer con esto

  1. Explorar. Toda la biblioteca es legible por cualquier persona, incluidas las que no están registradas. Esta parte no cuesta nada y no necesita cuenta.
  2. Desplegar una como bot. Esto requiere un plan de pago, y 20 de las 30 estrategias están marcadas como Premium y necesitan Anny Pro. Cuál es cuál está indicado antes de que hagas clic en nada. Tú eliges el exchange, el capital y el stop; las reglas permanecen del lado del servidor.
  3. Modificarla. Cambia el tamaño de la posición, el stop, el take-profit, el timeframe. En cuanto cambias cualquiera de esos elementos, los números de la página dejan de describir lo que estás ejecutando. El re-test diario siempre rastrea la versión sin modificar.
  4. Añadir monedas. Ejecuta el mismo enfoque en otros activos, con la advertencia de que cada métrica publicada fue obtenida en un activo. En una moneda nueva es una idea sin testar hasta que se le hace backtest allí.
  5. Construir un portfolio. Ejecuta varios bots a la vez, con una vista de portfolio que avisa cuando todos están haciendo silenciosamente la misma apuesta, porque los activos que se mueven juntos no son diversificación.
  6. Qué cuesta

    Explorar no cuesta nada. Ejecutar una estrategia cuesta un plan de pago y nada más: no se consumen créditos al copiar una estrategia en un bot, no hay comisión por estrategia, no hay comisión de marketplace.

    Construimos el Lab porque la alternativa es ejecutar una búsqueda de 9.385 combinaciones en tu propio hardware para obtener cuatro respuestas de ella, con una muestra retenida que tienes que acordarte de retener tú mismo. Ejecutar esa búsqueda una vez y dar los supervivientes a todo el que tenga un plan nos cuesta lo mismo que ejecutarla para una sola persona. Esa es la parte que Anny y Claude hacen posible, y por eso no tiene precio separado.

    Ese es el trato. Yo hago el rechazo, tú te quedas con lo que sobrevivió, y puedes ver cuándo un superviviente empieza a flaquear, incluso cuando va en contra nuestra.


    El Strategy Lab es investigación, no asesoramiento financiero. Anny no es asesora financiera. Todas las cifras mostradas provienen de backtests sobre datos históricos; el rendimiento pasado en backtests, incluyendo los resultados out-of-sample, no es indicativo de resultados futuros. Los backtests incluyen comisiones de exchange y slippage tal como se describe arriba, pero excluyen costes de financiación, y asumen que un stop-loss se ejecuta a su nivel. Los resultados en vivo diferirán. Opera solo con lo que puedes permitirte perder.