指南 · EA 开发

多少笔交易之后才能信任你的 EA?样本量、蒙特卡洛和 Z 分数

ConfirmedTrades 团队 · July 13, 2026 · 阅读约 8 分钟

四十笔交易是轶事。如何算出你的 EA 需要的样本量、1,000 次蒙特卡洛能补充什么,以及 Z 分数如何捕捉连胜连亏。

你实际在问的问题

“我的 EA 管用吗?”不是统计学能回答的问题。“如果 EA 没有优势,这个结果有多大可能?”才是。这样重新表述后,答案恰好取决于三件事:每笔优势的大小、每笔噪声的大小,以及交易数量。前两者由策略固定。第三个是你唯一能靠等待控制的,这就是为什么在算法交易中,每位有经验的开发者对“它准备好了吗”的回答都是“还没有”。

本指南给你把“还没有”量化的算术,然后展示 ConfirmedTrades 为你计算的两个工具:自助法蒙特卡洛和游程检验 Z 分数。

标准误差:信封背面的测试

取期望值(每笔平均利润)和每笔利润的标准差;两者都在账户页面上。期望值的标准误差是标准差除以交易数的平方根。期望值除以标准误差得到 t 统计量。低于约 2,你无法有把握地把优势与零区分开。

实例:期望值 8 美元,标准差 50 美元。100 笔交易后标准误差是 50 / 10 = 5 美元,t 统计量 1.6。还没到。要达到 t = 2,你需要 n 的平方根为 2 × 50 / 8 = 12.5,即 n = 156 笔。要达到谨慎的人开始相信的 t = 3,你需要 352 笔。把优势减半到 4 美元,这些数量翻四倍:625 和 1,406 笔。薄优势需要巨大的样本,而大多数第一个 EA 的优势都很薄。

The range of win rates consistent with a record, narrowing as trades accumulate90%72.5%55%37.5%20%50% — a coin tossthe real 55% edgefrom ~100 trades the edge is visible1025501002004008001600Closed trades in the recordWin rate
蓝色带是迄今记录仍能支持的胜率范围。在最初一百笔左右的交易里它仍然包含 50%——意味着无论总数多好看,数字还无法区分真正的优势和抛硬币。
这个检验假设交易相互独立且优势稳定。对网格和马丁格尔系统两者都不成立,它们的交易在设计上就是关联的。对它们而言,真实样本量是篮子数,而不是票据数。

交易数不够;你还需要时间

六周单边趋势市里的三百笔交易,告诉你的是 EA 在六周趋势中的表现。上面的统计假设交易来自同一分布,而市场状态的转变会打破它。你希望 EA 交易过震荡、趋势、波动率飙升和死寂期,实践中这意味着至少六个月,最好一年。评分的持续时间部分反映两个维度:账龄部分在 180 天拿满,交易数量部分在 200 笔拿满。

一个廉价的稳定性测试是按日期把记录分成两半,比较各自的期望值和盈利因子。如果后半段是与前半段不同的策略,样本就不是一个样本。账户页面上的自定义分析替你做这种筛选,交易记录多久才有意义涵盖同一问题的买家视角。

蒙特卡洛:一条历史,一千个未来

你的交易机器人前向测试的回撤是一次抽样。同样的交易以不同顺序发生会产生不同的最差回撤,可能深得多。ConfirmedTrades 的风险实验室运行自助法蒙特卡洛:从你 EA 自己的已平仓交易结果中有放回地随机抽取,重放与历史同样多的交易(最多 1,000 笔),重复 1,000 次。至少需要 20 笔交易才能运行。

你得到的是一张扇形图,带中位路径、中间 50% 和中间 90% 区间,以及中位结果、最好和最差 5%、预期最大回撤(各次运行的中位数)和第 95 百分位的坏运气回撤的卡片。破产概率阶梯随后报告模拟账户较今日余额下跌 10%、25%、50% 或 80% 的频率。

实际解读:历史最大回撤 12%,蒙特卡洛预期最大回撤 15%,第 95 百分位 27%。诚实的规划数字是 27%,不是 12%。如果 27% 的回撤会让你关掉 EA,你的仓位太大了;仓位管理与破产风险讲解如何修正。

Many reshuffled equity paths from a single trade history$26k$22k$18k$13k$9kstarting balancemedian outcomeunluckiest 5% still finish near $17kThe same trades, dealt in a different order
同一份交易历史,按多种不同顺序发牌。值得信任的记录是:即便不走运的排列,也结束在你能接受的位置。

蒙特卡洛看不到的

重采样假设未来的交易与过去相似。它无法凭空造出你尚未遇到的亏损行情,且把交易视为独立,因此对任何仓位关联的策略——网格、马丁格尔、对冲篮子——都会低估尾部风险。那些系统的危险存在于未平仓的篮子里,而模拟只看到已平仓的票据。信任扇形图之前,先看资金流中的最大回撤(净值)。

Z 分数:你的盈亏有连续性吗?

ConfirmedTrades 还显示游程检验 Z 分数。把交易按平仓时间排序,标记每笔为盈或亏,数游程:一个游程是连续同号结果的一段。Wald-Wolfowitz 检验把观察到的游程数与具有相同盈亏数的随机序列会产生的游程数比较。期望游程数是 2WL/N + 1,方差是 2WL(2WL − N) 除以 N²(N − 1)。Z 是观察值减期望值,除以方差的平方根。

实例:100 笔交易,60 盈 40 亏,观察到 35 个游程。期望游程数是 2 × 60 × 40 / 100 + 1 = 49。方差约 22.8,标准差 4.77,Z = (35 − 49) / 4.77 = −2.9。页面把它转换为置信度,这里超过 99%,即连续性不是随机的。

强负的 Z 意味着盈后盈、亏后亏。对趋势 EA 这是预期之中的,甚至可以利用。对高胜率的外汇机器人则是警告:亏损成簇,所以最长连亏会比独立性假设预测的更长,蒙特卡洛会过于乐观。强正的 Z 意味着交替,有时指向一个每次止损后反转的 EA。接近零且样本小,则暂时什么也说明不了。

里程碑

把这些写下来,事后不要挪动。

  • 20 笔以下或 30 天以内:按规则,尚无评分也尚无 AI 评估。这是对的。
  • 20 到 30 笔:短记录标记。看行为(持仓时间、止损、品种),不看表现。
  • 100 笔:计算 t 统计量。低于 1.5 继续等;高于 3 检查是否有隐藏的篮子。
  • 200 笔且 6 个月:评分不再因样本扣分;运行蒙特卡洛,按第 95 百分位回撤定仓位。
  • 此后每 100 笔:重新检查对半切分。真正的优势保持同样的形状。

免费工具

期望值计算器破产风险计算器免费并在浏览器中运行。连接前向测试终端并发布也是免费的;注册,让交易数自己往上爬。

一站式完成

在 ConfirmedTrades,每个已发布的账户都会显示其验证徽章、标记马丁格尔、网格和缺失止损的 AI 策略分析、完整的回撤与风险统计,以及按品种的执行成本——让你在信任一套策略之前先审查它,或证明你自己的策略。

所有指南