Loading market data...

Dolores Research 推出面向 AI 交易代理的开源基准测试

Dolores Research 推出面向 AI 交易代理的开源基准测试

Dolores Research 发布了 WAGMI Bench,这是一个开源基准测试,用于评估在 Virtuals Protocol 上运行的 AI 交易代理。该框架旨在为开发者和研究人员提供一种标准化方式,来测试这些代理在金融市场中的决策能力。

此次发布正值 AI 驱动的交易工具大量涌现之际,但衡量其性能的方式却缺乏一致性。WAGMI Bench 旨在通过提供一套通用的测试和指标来改变这一现状。

WAGMI Bench 的实际功能

该基准测试本身并非交易机器人,而是一个测试平台。开发者将他们的 AI 代理接入框架,框架会通过一系列交易场景运行这些代理并对其表现进行评分。由于它是开源的,任何人都可以检查代码、提出修改建议或在其基础上进行构建。

这种开放设计是刻意为之。WAGMI Bench 的开发者希望摆脱难以复现或验证的黑箱式评估。代码公开可见后,关于代理能力的声明就更容易得到检验。

开源为何重要

透明度对这个项目来说不仅仅是一个流行词。在一个单笔糟糕交易就可能让基金血本无归的领域,确切了解基准测试的运作方式至关重要。封闭的系统可能隐藏偏见或有缺陷的假设,而开放的系统则让社区能够找出其中的问题。

这也是为什么该项目托管在 Virtuals Protocol 上,这是一个专为 AI 和机器学习应用构建的平台。通过将基准测试直接与协议绑定,Dolores Research 希望它能成为生态系统的自然组成部分,而非事后补充。

这对 AI 交易意味着什么

目前,任何在 Virtuals 上构建 AI 交易代理的人都必须自行决定如何测试。有些人使用历史数据,有些人进行模拟交易,还有些人直接将其投入市场观察结果。WAGMI Bench 提供了一个一致的基准线。

它不承诺盈利或奇迹,只是在受控条件下提供更清晰的代理能力图景。这种清晰度可以帮助开发者改进模型,帮助用户做出更明智的信任决策。

该基准测试已上线,可通过 Virtuals Protocol 访问。开发者今天就可以开始将他们的代理接入测试,而开源特性意味着该框架将随着更多人的贡献而不断演进。

它能否成为 AI 交易评估的首选标准还有待观察,但此次发布为社区提供了一个坚实的起点。