Estratégiastrategy-labbacktestingout-of-sampletransparencyvalidation

O Strategy Lab: trinta estratégias, e pelo menos dez estão abaixo do nosso próprio critério

16 de agosto de 2026·8 min de leitura
O Strategy Lab: trinta estratégias, e pelo menos dez estão abaixo do nosso próprio critério

Esse é o número que uma biblioteca de estratégias não deveria publicar.

No re-teste de hoje (16 de agosto de 2026), pelo menos 10 das 30 estratégias do Anny Strategy Lab estão abaixo de um ou mais dos critérios que exigimos para publicação. Elas ainda estão na página. Ainda podem ser copiadas. Os números que reprovam cada uma estão exibidos nelas.

"Pelo menos" está fazendo um trabalho de verdade nessa frase. O re-teste diário recalcula seis dos sete critérios abaixo — trades, win rate, Sharpe, drawdown, degradação fora da amostra, Sharpe fora da amostra. O sétimo, a contagem de trades fora da amostra, é verificado na publicação e não é armazenado para re-verificação. Então 10 é um piso, não um total exato, e a direção honesta de arredondar é para cima.

Essa contagem muda todos os dias, nos dois sentidos. Dois dias atrás eram 18. A página da estratégia traz o número atual, e é esse que vale — não este aqui.

Publicamos isso porque uma biblioteca cujos números só melhoram é uma biblioteca que não está re-testando. Está re-imprimindo o dia em que foi publicada.

Veja como funciona, critério por critério.

O que a busca rejeita de verdade

Na nossa varredura mais recente registrada, executada antes de 16 de agosto de 2026, o Lab testou 9.385 combinações de parâmetros. Vinte e cinco delas produziram trades suficientes para serem avaliadas contra o critério de qualidade. Quatro foram publicadas.

Seja preciso sobre o que aconteceu com as outras 9.360: a grande maioria nunca gerou o mínimo de trinta trades, então não havia nada a julgar. Esse é um filtro mecânico, não um veredicto de que cada uma delas perderia dinheiro. Nenhuma delas foi executada com capital real, e não estamos afirmando o contrário.

As varreduras são iniciadas deliberadamente, manualmente, quando decidimos rodar uma. Não há cronograma nem promessa sobre com que frequência a biblioteca cresce. A parte diária desse sistema é o re-teste, não a busca.

O critério

Para ser elegível para publicação, um candidato precisa passar por todos os sete critérios abaixo:

CritérioLimite
Trades fechados no backtestpelo menos 30
Win ratepelo menos 40%
Sharpe ratiopelo menos 0,5
Drawdown máximonão pior que 35%
Degradação fora da amostranão pior que 50%
Sharpe fora da amostrapelo menos 0,3
Trades fora da amostrapelo menos 8

Cada número acima é medido em trades que pagam custos. Cada lado de cada trade é cobrado com uma taxa taker de 0,1% mais slippage: 0,1% em majors, 0,3% em todo o resto. Uma viagem de ida e volta em uma altcoin cede 0,8% antes de poder mostrar lucro. Backtests que ignoram isso são a razão pela qual uma estratégia com 42% de win rate parece viável num gráfico e não é viável em uma exchange.

Dois pisos adicionais se aplicam por cima: um Sharpe ratio probabilístico de pelo menos 0,6 medido nos dados fora da amostra, e lucratividade em pelo menos metade dos períodos de walk-forward.

Uma limitação honesta, já que estamos citando um Sharpe probabilístico ao lado de uma contagem de cinco dígitos de candidatos: essa probabilidade não é ajustada para baixo em função de quantas combinações testamos. Pesquise 9.385 candidatos e alguns vão passar qualquer critério fixo por sorte. A amostra retida abaixo é o que usamos para capturar isso, não o número do PSR. Corrigir o critério pelo tamanho da busca está na nossa lista e ainda não foi implementado.

Passar por todos os critérios torna um candidato elegível. É um teste de entrada, feito uma vez, no dia da publicação. O que acontece depois está mais abaixo nessa página.

O que "fora da amostra" significa aqui

O histórico de cada estratégia é dividido cronologicamente. Os primeiros 80% são usados para encontrá-la e ajustá-la. A busca de parâmetros nunca lê os 20% finais — nenhum parâmetro de candidato é escolhido, pontuado ou classificado usando esse trecho. A estratégia sobrevivente é então executada nesse trecho final intocado, e se desmoronar ali não é publicada, por melhor que tenham sido os primeiros 80%.

Também dividimos o histórico completo em quatro períodos sequenciais e verificamos se a estratégia se sustentou em todos eles, em vez de dever seu resultado a um mês de sorte. Para ser exato: os parâmetros ficam fixos em todos os quatro períodos, então o que isso mede é consistência. Re-otimizar dentro de cada janela seria walk-forward optimisation, o que é uma afirmação diferente e mais forte do que a que estamos fazendo.

9.385 combinações foram ajustadas nos primeiros 80%. Quatro ainda estavam de pé após os 20% finais. Essa diferença é o que uma amostra retida custa a um candidato, e o que ignorá-la teria nos deixado publicar.

Peak Fader em DOT: métricas dentro da amostra acima, validação fora da amostra abaixo, incluindo um índice de degradação
Peak Fader em DOT: métricas dentro da amostra acima, validação fora da amostra abaixo, incluindo um índice de degradação

Peak Fader em DOT, conforme publicado. O bloco superior é o que a estratégia fez ao longo de todo o seu histórico. O bloco inferior é os 20% retidos que ela nunca viu durante o ajuste, incluindo o quanto decaiu. Ambos estão na página pública, lado a lado.

O que está na biblioteca hoje

Em 16 de agosto de 2026: 30 estratégias, distribuídas em 15 ativos e 14 tipos distintos de estratégia. A menor tem 30 trades fechados por trás dela e a média tem 45. Esses são trades simulados de backtest, não histórico de trading ao vivo.

Cada estratégia está na fila para um re-backtest com dados de mercado frescos diariamente, e os números na sua página são substituídos pelo que esse re-teste retornar. O resultado é exibido mesmo quando é pior do que no dia em que foi publicada, o que é como uma estratégia publicada acaba mostrando um Sharpe fora da amostra negativo em público.

Aqui está uma delas, no ar no site agora:

Momentum Rider em SOL: Sharpe 0,23, Sharpe fora da amostra -1,49, degradação 100%
Momentum Rider em SOL: Sharpe 0,23, Sharpe fora da amostra -1,49, degradação 100%

Momentum Rider em SOL. Um Sharpe de 0,23 contra nosso piso de 0,5, um Sharpe fora da amostra de −1,49, e degradação travada no limite de +100. Está publicada, pode ser copiada, e esses são os números que exibimos para ela.

Duas coisas para entender sobre isso:

Um alerta não é uma remoção. O re-teste diário marca uma estratégia que caiu abaixo de um critério. Não a retira. Uma estratégia reprovada permanece na biblioteca, ainda copiável, com seus critérios reprovados exibidos. Retirar uma é uma decisão que uma pessoa toma deliberadamente. Trate um alerta como um aviso que você precisa agir, não como uma limpeza que já fizemos por você.

O índice de decaimento tem um limite. Expressamos a degradação em relação ao backtest original como uma porcentagem limitada a ±100, onde um número positivo significa que o trecho fora da amostra foi pior e um número negativo significa que foi melhor. Uma estratégia mostrando +100 decaiu pelo menos essa quantidade e possivelmente mais. Nove das trinta estão exatamente em uma das extremidades desse limite hoje: quatro em +100, cinco em −100. Para essas nove, o número exibido subestima o quanto elas realmente se moveram.

As regras ficam privadas, em todos os planos

Você vê as métricas que permitem julgar uma estratégia: histórico completo de trades, curva de equity, win rate, drawdown, resultados fora da amostra e em quais regimes de mercado funcionou.

Você não vê os valores exatos dos parâmetros. Nem no Free, nem no Pro, nem no Pro Max. A maioria dos produtos nessa categoria vende esses números no tier mais alto; os nossos são retidos em todos os tiers, razão pela qual esta seção termina sem um botão de upgrade.

Todas as superfícies do produto os retêm, incluindo chat e links compartilhados. Se você encontrar algum caminho que os retorne, nos avise e nós o fecharemos.

Você pode executar uma estratégia sem eles. A execução é server-side: as regras rodam nas nossas máquinas e nunca são enviadas para seu navegador, sua configuração de bot ou sua conta na exchange.

O que você faz com isso

  1. Navegar. A biblioteca inteira pode ser lida por qualquer pessoa, incluindo quem não está logado. Essa parte não custa nada e não precisa de conta.
  2. Implantar uma como bot. Isso requer um plano pago, e um plano pago inclui todas as trinta — as marcadas como Premium não são uma compra separada. Você escolhe a exchange, o capital e o stop; as regras ficam server-side.
  3. Modificar. Altere o tamanho da posição, o stop, o take-profit, o timeframe. Depois de mudar qualquer um desses, os números na página param de descrever o que você está executando. O re-teste diário sempre rastreia a versão não modificada.
  4. Adicionar moedas. Execute a mesma abordagem em outros ativos, com a ressalva de que cada métrica publicada foi conquistada em um ativo. Em uma nova moeda é uma ideia não testada até ser submetida a backtest lá.
  5. Montar um portfólio. Execute vários bots ao mesmo tempo, com uma visão de portfólio que alerta quando todos estão silenciosamente fazendo a mesma aposta, porque ativos que se movem juntos não são diversificação.
  6. O que custa

    Navegar não custa nada. Executar uma estratégia requer um plano pago e nada além disso: nenhum crédito é consumido quando você copia uma estratégia para um bot, nenhuma taxa por estratégia, nenhuma comissão de marketplace.

    Construímos o Lab porque a alternativa é rodar uma busca de 9.385 combinações no seu próprio hardware para obter quatro respostas, com uma amostra retida que você precisa lembrar de reter por conta própria. Rodar essa busca uma vez e entregar os sobreviventes a todos em um plano custa o mesmo que rodá-la para uma pessoa. Essa é a parte que Anny e Claude tornam possível, e é por isso que não tem preço separado.

    Esse é o acordo. Anny faz as rejeições, você recebe o que sobreviveu, e você pode ver quando um sobrevivente começa a escorregar — inclusive quando vai contra nós.


    O Strategy Lab é pesquisa, não aconselhamento financeiro. Anny não é uma consultora financeira. Todos os números exibidos são de backtests em dados históricos; a performance passada em backtest, incluindo resultados fora da amostra, não é indicativa de resultados futuros. Os backtests cobram taxas de exchange e slippage conforme descrito acima, mas excluem custos de funding e assumem que um stop-loss é preenchido no seu nível. Resultados ao vivo serão diferentes. Opere apenas o que você pode se dar ao luxo de perder.