量化交易还是 AI:Jev、Claude 和 Python 黄金实测
量化交易与 AI 谁更好?我把 Jev、Claude 和一个不用 AI 的 Python 脚本接入同一个 MT5 黄金指标,用相同数据和相同规则比较它们的买卖区间。
Jev 大约一秒就能决定黄金的卖出和买入区间,花费不到 0.1 美分,而 Claude 需要两分半钟和 4 美分。Jev 是一种新型 AI 模型,在交易中还很少有人用:它不写文字,只做判断。我把它接入了我的 MetaTrader 5 指标 AI Zones,替代 Claude。
为了知道它能否比得上原版,以及 AI 是否比传统的量化交易更好,我让三个版本并排运行:Jev、Claude,以及一个完全不用 AI 的 Python 版本。下面依次介绍:Jev 的工作方式、我为什么想替换 Claude、三个引擎的对比、9 月 25 日(周五)晚上的区间、比赛规则,以及定制指标服务。
要点速览
- Jev(TypeSafe AI 出品,可通过 Vercel AI Gateway 使用)不生成文字,而是用选项、评分和概率回答封闭式问题。
- 在黄金上,Jev 一次调用回答 35 个问题,耗时约一秒,每次分析不到 0.001 美元;Claude 约需 145 秒和 0.04 美元。
- 三个引擎使用同样的数据:Claude 全部自己写,Jev 判断 Python 准备好的区间,纯 Python 版用固定规则作为对照组。
- 9 月 25 日 20:10,三者都提出在前一日高点(4,303.26)下方卖出;Jev 的止损最低(4,307.5,另外两个是 4,312 和 4,318)。
- 三者都还没有证明能赚钱:要下结论,每个引擎需要几十个已结束的区间。

9 月 25 日(周五)晚上由 Jev 驱动的 AI Zones(XAUUSD,5 分钟图)。每个矩形从区间创建的时间开始,标题中也写明了时间(“créée 20:08”)。图上文字为法语。
Jev:一个只判断、不写作的模型
Jev 不写回答:它接收一个状态和一组封闭式问题,然后用概率回答每一个。我们熟悉的大多数 AI 都会写作:你提问,它们写出回答。Jev 由 TypeSafe AI 发布,可通过 Vercel 的 AI Gateway 使用,工作方式不同。
这里的状态,就是此刻关于黄金市场的全部已知信息。回答类似这样:94% 是,选项 A 占 51%,满分 3 分得 1.6 分。这些都是我第一次测试时它的真实回答。
- 35 个问题在一次调用中提出,每个候选区间 7 个。
- 约 1 秒得到全部回答,Claude 需要两分半钟。
- 不到 0.001 美元一次分析,约为 Claude 的四十分之一。
这种回答方式对指标来说意义重大。Jev 的每个决定都带着确定程度,而且它还会逐题返回自己的置信度。因为几乎不花钱,我可以每 5 分钟而不是每 15 分钟就请它重新判断一次。
为什么用 Python 加判断型 AI 替换 Claude
Claude 的区间都建立在程序自己就能算出的价位上,所以 AI 的主要作用是判断。AI Zones 的第一版每 15 分钟把黄金 K 线和财经日历发给 Claude,由它回复卖出和买入区间、止损和目标。效果不错,但每次分析约需两分半钟,花费 4 美分。
重读它的回答时,我发现了一件简单的事。Claude 当天提出的 6 个不同区间,全都建立在程序自己就能算出的价位上:当日和前一日的高低点,以及 15 分钟 K 线的高点和低点,每次误差都在 3 美元以内。它的止损放在下一个价位后面,目标放在相反价位前面。
换句话说,这些数字 Python 就能算出来。Claude 真正提供的是判断:哪个价位值得做,选哪个止损。这正是 Jev 发挥作用的地方。
AI 还是量化交易:三个引擎的对比
三个引擎读取同样的黄金数据,唯一的区别是决策方式。Claude 决定一切,Jev 在 Python 准备好的选项中选择,而纯 Python 版不用 AI、只用固定规则:这才是严格意义上的量化交易,也就是对照组。
| 引擎 | 作用 | 耗时 | 每次成本 | 频率 |
|---|---|---|---|---|
| Claude | 读取 K 线并写出一切:区间、止损、目标、评论 | 约 145 秒 | 约 0.04 美元 | 15 分钟 |
| Jev | Python 提出带价格的区间,Jev 判断每个条件并选择止损和目标 | 1 到 5 秒 | 不到 0.001 美元 | 5 分钟 |
| 纯 Python | 同样的候选区间、同样的条件,按固定规则判定 | 即时 | 0 美元 | 5 分钟 |
Jev 如何做决定
Jev 不会写价格,所以由 Python 准备好一切,再向它提封闭式问题。Python 计算当日、前一日和本周的价位,每个候选区间的触及次数、最后一次接触时的影线长度、趋势、即将公布的数据、三个可选止损和可选目标。然后对每个区间,在一次调用中提出 7 个问题:
- 这个价位重要吗(当日、前一日、本周、平台)?是或否。
- 这笔交易顺势吗?是或否。
- 价格是否明显拒绝了这个价位?是或否。
- 第一个目标的收益是否至少等于风险?是或否。
- 选哪个止损:A(窄)、B(下一个价位后面)还是 C(宽)?
- 在给出的价位中,选哪个作为第一个目标?
- 质量如何,从“应避免”到“极好”?
5 个候选区间就是 35 个问题,大约一秒处理完。然后 Python 把回答组合成区间、计算手数,并写入和 Claude 版相同的文件。指标本身看不出区别。
黄金第一轮,周五晚上
9 月 25 日 20:10(MT5 时间),黄金在 4,284,三个引擎都提出在前一日高点下方卖出,但止损位置不同。以下是各引擎的区间:
| 引擎 | 区间 | 价格范围 | 止损 | 目标 1 | 置信度 |
|---|---|---|---|---|---|
| Claude | 卖出 S1 | 4,296.0-4,308.0 | 4,318.0 | 4,276.0 | 62% |
| Claude | 买入 B1 | 4,255.0-4,266.0 | 4,242.0 | 4,282.0 | 55% |
| Jev | 卖出 S-4303 | 4,286.5-4,303.5 | 4,307.5 | 4,275.5 | 68% |
| Jev | 买入 B-4264 | 4,264.5-4,281.0 | 4,260.5 | 4,293.5 | 49% |
| Python | 卖出 S-4303 | 4,296.0-4,303.5 | 4,312.0 | 4,275.5 | 80% |
| Python | 买入 B-4255 | 4,254.5-4,261.5 | 4,242.0 | 4,286.5 | 80% |
| Python | 卖出 S-4316 | 4,309.0-4,315.5 | 4,324.0 | 4,275.5 | 80% |


Claude 的图(上)和 Python 的图(下),与上方 Jev 的图同一时刻、同一品种(15 分钟图)。
三个引擎在关键点上一致:在下跌趋势中,于前一日高点(4,303.26)下方卖出。分歧在细节上。Jev 的止损离前一日高点最近:4,307.5,Python 是 4,312,Claude 是 4,318。但 Jev 的卖出区间起点更低(4,286.5):首次触及时它的风险是 21 点,Python 是 16 点,Claude 是 22 点。在同样 700 美元风险下,根据图上面板,Jev 是 0.33 手,Python 是 0.43 手,Claude 是 0.31 手。Python 给出的区间最多,Jev 和 Claude 更挑剔。
各引擎的百分比不能互相比较。Claude 的是它的判断,Jev 的是概率和评分的组合,Python 的是满足条件的比例。
比赛规则和我在关注的事
三个引擎都用完全相同的方式,在真实的 1 分钟 K 线上评估,得分用 R 表示。为了公平:
- 区间只有在创建后价格来到它时才算数。 图上有一个箭头标出这一刻:“entrée 20:15”。
- 然后看谁先到: 目标 TP1(绿色对勾)还是止损(红色叉)。如果在同一分钟内两者都被触及,算作止损。
- 得分用 R 表示: 止损记 −1,TP1 记收益除以风险。目标较远且成功的区间,比目标较近的区间得分更高。
- 区间保持稳定。 一个区间的数字不会在每次分析时变化;只有在入场后止损或目标被触及,或不再满足条件时才会消失。
记分表会随每次分析自动更新。每个引擎需要几十个已结束的区间才能下任何结论:达到这个数量后,我会做第一次总结。
我已经在关注的事
第一个晚上就有三点值得注意:Jev 的稳定性、它的犹豫,以及不用 AI 的对照组成绩。
- Jev 的稳定性。 第一个晚上它就三次回复“服务暂时不可用”。这时它的图 5 分钟内不会更新。Claude 一次都没出故障。
- 它的犹豫。 在一个测试区间上,Jev 以 51% 对 49% 选择止损,几乎是抛硬币。好在它会为每个回答返回自己的置信度,可以把最不确定的回答剔除。
- 对照组。 如果免费、不用 AI 的 Python 版和 Jev 表现一样好,就该保留 Python 版。AI 必须证明自己有价值。
这三个引擎都还没有证明能在黄金上赚钱。这些区间告诉我该盯住哪里,而不是闭着眼睛照做。这次比较正是为了用数字来衡量这一点。
用你选择的 AI 定制 MT5 指标
我以自由职业的方式开发这类工具,价格约 500 欧元。如果你在 MetaTrader 5 上交易,想要一个用 Jev、Claude 这样的 AI,或用固定规则来画区间的指标,我可以按你的品种和规则来开发。
| 项目 | 说明 |
|---|---|
| 平台 | MetaTrader 5 |
| 引擎 | Jev、Claude 或固定规则 |
| 品种 | 你指定的 |
| 安装 | 包含 |
| 价格 | 约 500 欧元 |
包含内容:
- 卖出和买入区间、止损和目标;
- 按你选择的风险计算手数;
- 创建时间,以及入场、TP 和 SL 标记;
- 暂停或重启分析的按钮。
这是一个决策辅助工具:它只显示区间,不下任何订单,也不承诺任何收益。如需沟通,请发邮件至 wdltradingapi@gmail.com。如果你想在指标中加入财经数据,我的 Forex Calendar Pro 财经日历可以通过 API 提供。
常见问题
TypeSafe 的 AI 模型 Jev 是什么?
Jev 是 TypeSafe AI 发布的决策模型,可通过 Vercel AI Gateway 使用。它不写文字,而是根据类型化的问题评估给定的状态,返回选项、评分和概率。一次调用可以处理多个问题:在我的黄金指标里,是约一秒处理 35 个问题。
量化交易能赚钱吗?和 AI 相比呢?
目前没有任何一个引擎证明能赚钱,这正是测试的目的。Claude、Jev 和不用 AI 的 Python 版在同样的黄金数据上运行,用同样的 R 计分规则。如果固定规则免费就能做得和 Jev 一样好,我就保留固定规则。每个引擎需要几十个已结束的区间才能下结论。
Claude 还是 Jev:交易指标该选哪个 AI?
在速度和成本上,Jev 明显领先:每次分析约一秒、不到 0.001 美元,而 Claude 是 145 秒和 0.04 美元。在稳定性上,Claude 更好:Jev 第一个晚上就有三次不可用。至于区间质量,目前还没有任何测量结果。
如何公平地比较交易引擎?
用完全相同的方式在真实的 1 分钟 K 线上评估它们。在我的测试中,区间只有在创建后价格来到它时才算数,然后看 TP1 和止损谁先被触及。止损记 −1 R,TP1 记收益除以风险,同一分钟内同时触及则算作止损。
定制一个 MT5 指标要多少钱?
约 500 欧元,含安装,是一个在你指定的品种上用 Jev、Claude 或固定规则画出买卖区间的 MetaTrader 5 指标。它按你选择的风险计算手数,并显示止损和目标。它不下任何订单,也不保证任何收益。
交易日志的所有文章都汇总在博客。
本文不构成投资建议。保证金交易具有较高的本金亏损风险。
本内容仅为个人经验分享,不构成投资建议。交易杠杆产品存在较高的亏损风险。