策略strategy-labbacktestingout-of-sampletransparencyvalidation

策略实验室:三十个策略,至少十个低于我们自己的标准

2026年8月16日·8 分钟阅读
策略实验室:三十个策略,至少十个低于我们自己的标准

这是一个策略库不应该公开的数字。

在今天的重新测试中(2026年8月16日),Anny Strategy Lab 中30个策略里,至少有10个未能达到我们发布所要求的一个或多个门槛。 它们依然挂在页面上,依然可以复制,每个策略上都标注了未达标的数据。

"至少"这两个字在这句话里承担着真实的分量。每日重测会重新计算以下七个关卡中的六个——交易次数、胜率、Sharpe 比率、回撤、样本外衰减、样本外 Sharpe。第七项,样本外交易次数,在策略发布时检查一次,之后不再存储用于复检。所以10是下限,不是精确总数,而诚实的方向是往上取整。

这个数字每天都在变动,方向不定。两天前是18。策略页面上显示的是当前数字,那个才是准的,而不是这里写的。

我们公开这个数字,因为一个数字只会越来越好看的策略库,根本就不是在重新测试——它只是在重新打印发布当天的结果。

下面逐关说明这套系统是怎么运作的。

搜索究竟在淘汰什么

在最近一次有记录的扫描中(2026年8月16日之前运行),实验室回测了 9,385个参数组合。其中只有25个产生了足够的交易次数,可以接受质量标准的评估。最终有四个被发布。

关于其余9,360个的去向,需要说清楚:绝大多数从未产生最低30次交易,因此根本没有可评判的内容。这是一个机械性过滤,不是对它们会亏损的判断。它们从未用真实资金运行过,我们也没有这样声称。

扫描是人工手动发起的,在我们决定运行时才执行。没有固定计划,也没有关于库多久增长一次的承诺。这套系统中每日进行的部分是重新测试,而不是搜索。

门槛标准

一个候选策略必须通过以下全部七项,才具备发布资格:

关卡门槛
已完成回测交易次数至少30次
胜率至少40%
Sharpe 比率至少0.5
最大回撤不超过35%
样本外衰减不超过50%
样本外 Sharpe至少0.3
样本外交易次数至少8次

以上所有数据均在扣除成本后的交易基础上计算。每笔交易的每一侧都收取0.1%的 taker 手续费加滑点:主流资产0.1%,其他资产0.3%。因此一笔山寨币的来回交易在能够盈利之前就要损耗0.8%。跳过这一步的回测,就是为什么一个胜率42%的策略在图表上看起来可行,而在交易所上根本不可行。

此外还有两项额外底线:样本外数据上的概率 Sharpe 比率至少达到0.6,以及在至少一半的 walk-forward 周期内实现盈利。

有一个诚实的局限性,既然我们把概率 Sharpe 和五位数的候选数量放在一起引用:这个概率没有针对我们测试的组合数量进行下调校正。 搜索9,385个候选组合,其中一些仅凭运气就能通过任何固定门槛。我们依赖下文所述的留存样本来捕捉这种情况,而不是依赖 PSR 数字。针对搜索规模调整门槛是我们的待办事项,目前尚未构建。

通过所有关卡才具备候选资格。这是一次入场测试,在发布当天进行一次。之后发生的事情在本页面下方有说明。

这里的"样本外"是什么意思

每个策略的历史数据按时间顺序拆分。前80%用于发现和调参。参数搜索从不读取最后20%的数据——没有任何候选策略的参数是基于它来选择、评分或排名的。然后将存活下来的策略在这段未经触碰的最后数据上运行,如果在那里崩溃,无论前80%表现多好,都不予发布。

我们还将完整历史数据切分为四个连续时期,检验策略是否在所有时期都保持稳定,而不是把结果归功于某个幸运的月份。准确地说:参数在所有四个时期内保持不变,所以这衡量的是一致性。在每个窗口内重新优化将是 walk-forward 优化,那是比我们所主张的更强的一种声明。

9,385个组合在前80%上进行了调参。四个在经过最后20%之后仍然站立。这个差距就是留存样本对候选策略的代价,也是跳过它本会让我们发布的结果。

DOT 上的 Peak Fader:上方为样本内指标,下方为样本外验证,包含衰减数据
DOT 上的 Peak Fader:上方为样本内指标,下方为样本外验证,包含衰减数据

DOT 上的 Peak Fader,已发布版本。上方区块是策略在完整历史中的表现。下方区块是调参期间从未见过的留存20%,包括衰减幅度。两者并排显示在公开页面上。

今天库中有什么

截至2026年8月16日:30个策略,覆盖15个资产和14种不同策略类型。 最小的策略有30笔已完成交易作为支撑,平均45笔。这些是模拟回测交易,而非实盘交易历史。

每个策略每天都会在新的市场数据上排队进行重新回测,页面上的数字会被该次重测的结果替换。即使结果比发布当天更差,也会被打印出来——这就是为什么一个已发布策略会在公开页面上显示负的样本外 Sharpe。

以下是其中一个,现在就在网站上:

SOL 上的 Momentum Rider:Sharpe 0.23,样本外 Sharpe -1.49,衰减100%
SOL 上的 Momentum Rider:Sharpe 0.23,样本外 Sharpe -1.49,衰减100%

SOL 上的 Momentum Rider。Sharpe 为0.23,低于我们0.5的底线;样本外 Sharpe 为−1.49;衰减固定在+100的上限。它已发布,可以复制,这些就是我们为它展示的数据。

关于这一点,有两件事需要理解:

标记不等于下架。 每日重测会标记一个跌破门槛的策略,但不会撤回它。未达标的策略依然留在库中,依然可以复制,其未通过的关卡会被显示出来。下架一个策略是需要人工主动决定的事情。请把标记视为你必须采取行动的警告,而不是我们已经替你做好的清理。

衰减数据有上限。 我们将样本外相对于原始回测的衰减表达为一个百分比,上限为±100,正数意味着样本外阶段更差,负数意味着更好。显示+100的策略衰减幅度至少为这个数,实际可能更多。今天三十个策略中有九个正好落在上限的某一端:四个在+100,五个在−100。对于这九个策略,显示的数字低估了它们实际移动的幅度。

规则在所有方案中保持私密

你能看到让你判断一个策略所需的指标:完整的交易历史、权益曲线、胜率、回撤、样本外结果,以及它在哪些市场状态下有效。

你看不到精确的参数值。Free 方案不行,Pro 方案不行,Pro Max 方案也不行。这个类别中的大多数产品会在顶级套餐中出售这些数字;我们在每个套餐都不提供,这也是为什么本节结尾没有升级按钮。

所有产品界面都会保密参数,包括聊天和共享链接。如果你发现了任何能返回这些数据的路径,请告诉我,我会关闭它。

你不需要这些参数就能运行策略。执行在服务器端进行:规则在我们的机器上运行,从不发送到你的浏览器、你的机器人配置或你的交易所账户。

你可以用它做什么

  1. 浏览。 整个库对任何人开放,包括未登录的用户。这部分免费,无需账号。
  2. 将其部署为机器人。 这需要付费方案,付费方案包含全部三十个策略——标注 Premium 的不是单独购买的。你选择交易所、资金和止损;规则本身保留在服务器端。
  3. 修改它。 更改仓位大小、止损、止盈、时间框架。一旦你更改了其中任何一项,页面上的数据就不再描述你正在运行的内容。每日重测始终追踪未修改的版本。
  4. 添加币种。 在其他资产上运行相同的方法,但需注意每一项已发布的指标都是在单一资产上取得的。在新币种上,它是一个未经测试的想法,直到在那里完成回测为止。
  5. 构建投资组合。 同时运行多个机器人,配合投资组合视图,当它们悄悄做出相同的赌注时会发出标记——因为一起波动的资产不是分散投资。
  6. 费用是多少

    浏览免费。运行策略需要付费方案,除此之外没有额外费用:复制策略到机器人不消耗积分,没有按策略收费,也没有市场分成。

    我打造实验室,是因为另一种选择是在你自己的硬件上运行9,385个组合的搜索,从中得出四个答案,还要记住为自己保留一个留存样本不去读取。运行一次搜索并将存活结果提供给方案内的所有人,和只为一个人运行的成本对我来说是一样的。这是 Anny 和 Claude 让这一切成为可能的部分,也是它不单独定价的原因。

    就是这个安排。拒绝的工作由我来做,存活下来的内容由你获得,而且当一个存活者开始滑落时你能看到——包括当它对我们不利的时候。


    Strategy Lab 是研究内容,不构成财务建议。Anny 不是财务顾问。所有显示的数据均来自历史数据的回测;过去的回测表现(包括样本外结果)不代表未来结果。回测如上所述收取交易所手续费和滑点,但不包括资金费率,且假设 stop-loss 在其设定价位成交。实盘结果会有所不同。请只交易你能承受损失的资金。

相关文章