Dolores Research 发布了 WAGMI Bench,这是一个开源基准测试,用于评估在 Virtuals Protocol 上运行的 AI 交易代理。该框架旨在为开发者和研究人员提供一种标准化方式,来测试这些代理在金融市场中的决策能力。
此次发布正值 AI 驱动的交易工具大量涌现之际,但衡量其性能的方式却缺乏一致性。WAGMI Bench 旨在通过提供一套通用的测试和指标来改变这一现状。
WAGMI Bench 的实际功能
该基准测试本身并非交易机器人,而是一个测试平台。开发者将他们的 AI 代理接入框架,框架会通过一系列交易场景运行这些代理并对其表现进行评分。由于它是开源的,任何人都可以检查代码、提出修改建议或在其基础上进行构建。
这种开放设计是刻意为之。WAGMI Bench 的开发者希望摆脱难以复现或验证的黑箱式评估。代码公开可见后,关于代理能力的声明就更容易得到检验。
开源为何重要
透明度对这个项目来说不仅仅是一个流行词。在一个单笔糟糕交易就可能让基金血本无归的领域,确切了解基准测试的运作方式至关重要。封闭的系统可能隐藏偏见或有缺陷的假设,而开放的系统则让社区能够找出其中的问题。
这也是为什么该项目托管在 Virtuals Protocol 上,这是一个专为 AI 和机器学习应用构建的平台。通过将基准测试直接与协议绑定,Dolores Research 希望它能成为生态系统的自然组成部分,而非事后补充。
这对 AI 交易意味着什么
目前,任何在 Virtuals 上构建 AI 交易代理的人都必须自行决定如何测试。有些人使用历史数据,有些人进行模拟交易,还有些人直接将其投入市场观察结果。WAGMI Bench 提供了一个一致的基准线。
它不承诺盈利或奇迹,只是在受控条件下提供更清晰的代理能力图景。这种清晰度可以帮助开发者改进模型,帮助用户做出更明智的信任决策。
该基准测试已上线,可通过 Virtuals Protocol 访问。开发者今天就可以开始将他们的代理接入测试,而开源特性意味着该框架将随着更多人的贡献而不断演进。
它能否成为 AI 交易评估的首选标准还有待观察,但此次发布为社区提供了一个坚实的起点。




