剔除日志:17,304 次从未走到关卡的测量
语料库扫描有四分之三在任何一道关卡开跑之前就被丢弃。下面是每一个桶及其数量——包括最大的那个,它有一部分是我们自己的问题。
公开发表的 backtest 研究习惯于展示幸存者。信息量更大的通常是另一端:流水线丢掉了什么,依据的又是哪条明说的规则。在这次日线语料库扫描中,3,797 个公开 Pine 策略跑了六个市场,合计 22,782 次 script-market 测量。走到关卡前的有 5,478 次。其余 17,304 次没有走到,而拦住它们的规则没有一条是质量判断。
equity 从未变动:4,755。脚本编译通过也跑起来了,但仓位从头到尾没变过。没有收益序列可测,除了“无可报告”之外没有别的可报告。
未能编译或崩溃:4,666。这个桶暴露我们引擎的问题不比暴露脚本的问题少,正因如此才把它公布出来,而不是悄悄剔除。resin 在 257 个脚本中的 251 个上与一个独立实现做过逐 bar 校验——这是关于编译器覆盖度的说法,不是说所有公开脚本都能编译。一条隐藏自身失败的流水线,报出来的语料库会比它实际配得上的干净。
已平仓交易少于 20 笔:4,014。这么小的样本撑不起关卡计算的那些统计量,附上一条注意事项照样报出去,只会造出一个被引用时把注意事项丢掉的数字。
在 98% 及以上的 bar 上持仓:1,694。在不到 2% 的 bar 上持仓:127。前者本身就几乎等同于 buy-and-hold,却要拿去和 buy-and-hold 比;后者几乎没有敞口可测。两种比较都不会是表头所说的那个意思。
隐含杠杆超过 1.5×:1,363。账户归零:685。两者都落在样本池其余部分所依据的仓位假设之外,所以直接剔除,而不是换一套跟别人不同的规则去打分。
按 script-market 对而不是按脚本计数的理由贯穿以上每一项。在 BTCUSD 上被剔除的一次测量,在 GOLD 上可能完全干净;把它折叠成一个按脚本的 verdict,等于凭空造出扫描从未做过的判断。公布这些桶,是为了让任何读到那 2 次通过全部四道关卡的测量的人,都清楚知道它们上面的漏斗有多大。