Dolores Research ka publikuar WAGMI Bench, një benchmark me burim të hapur i krijuar për të vlerësuar agjentët e tregtimit me AI që funksionojnë në Virtuals Protocol. Kuadri synon t'u japë zhvilluesve dhe studiuesve një mënyrë të standardizuar për të testuar se sa mirë këta agjentë marrin vendime në tregjet financiare.
Publikimi vjen në një kohë kur mjetet e tregtimit të drejtuara nga AI po shumohen, por me pak konsistencë në mënyrën se si matet performanca e tyre. WAGMI Bench synon ta ndryshojë këtë duke ofruar një grup të përbashkët testesh dhe metrikash.
Çfarë bën në të vërtetë WAGMI Bench
Benchmark-u nuk është vetë një bot tregtimi. Është një terren testimi. Zhvilluesit futin agjentët e tyre të AI në kuadër, i cili më pas i kalon ata nëpër një seri skenarësh tregtimi dhe vlerëson performancën e tyre. Duke qenë se është me burim të hapur, çdokush mund të inspektojë kodin, të sugjerojë ndryshime ose të ndërtojë mbi të.
Ky dizajn i hapur është një zgjedhje e qëllimshme. Njerëzit pas WAGMI Bench duan të largohen nga vlerësimet me kuti të zezë që janë të vështira për t'u riprodhuar ose verifikuar. Me kodin të dukshëm, pretendimet për aftësitë e një agjenti bëhen më të lehta për t'u kontrolluar.
Pse burimi i hapur ka rëndësi këtu
Transparenca nuk është vetëm një fjalë e modës për këtë projekt. Në një fushë ku një tregti e vetme e keqe mund të fshijë një fond, të dish saktësisht se si funksionon një benchmark është kritike. Një sistem i mbyllur mund të fshehë paragjykime ose supozime të gabuara. Një sistem i hapur i lejon komunitetit të gjejë të meta në të.
Kjo është gjithashtu arsyeja pse projekti është i vendosur në Virtuals Protocol, një platformë e ndërtuar tashmë për aplikacione të AI dhe mësimit të makinerive. Duke e lidhur benchmark-un direkt me protokollin, Dolores Research shpreson që ai të bëhet një pjesë natyrale e ekosistemit, jo një mendim i mëvonshëm.
Çfarë do të thotë kjo për tregtimin me AI
Tani, kushdo që ndërton një agjent tregtimi me AI në Virtuals duhet të vendosë se si ta testojë atë. Disa përdorin të dhëna historike, disa kryejnë tregti simuluese, të tjerë thjesht e lënë të lirë dhe shohin çfarë ndodh. WAGMI Bench ofron një bazë të qëndrueshme.
Ai nuk premton fitime apo magji. Thjesht jep një pamje më të qartë se çfarë mund të bëjë një agjent në kushte të kontrolluara. Kjo qartësi mund të ndihmojë zhvilluesit të përmirësojnë modelet e tyre dhe t'i ndihmojë përdoruesit të marrin vendime më të informuara se çfarë të besojnë.
Benchmark-u është tashmë i disponueshëm dhe i aksesueshëm përmes Virtuals Protocol. Zhvilluesit mund të fillojnë të testojnë agjentët e tyre kundrejt tij sot, dhe natyra me burim të hapur do të thotë se kuadri ka të ngjarë të evoluojë ndërsa më shumë njerëz kontribuojnë.
Nëse do të bëhet standardi kryesor për vlerësimin e tregtimit me AI mbetet për t'u parë, por publikimi i jep komunitetit një pikënisje solide.




