Anthropics AI-assistent Claude har kjørt 50 000 simuleringer av VM, basert på kampdata helt tilbake til 1872. Øvelsen var en del av en test av AI-assistert prognose i en prediksjonskonkurranse.
Omfanget av simuleringene
Hver simulering modellerte hele turneringen fra gruppespill til finale, med historiske resultater for å bestemme sannsynligheter. Datasettet dekker mer enn 150 år med internasjonal fotball, inkludert kamper fra den første offisielle internasjonale kampen i 1872 mellom Skottland og England. Claude behandlet disse dataene for å generere tusenvis av mulige utfall, med vektlegging av faktorer som lags form, innbyrdes oppgjør og turneringshistorikk.
Femti tusen kjøringer er et stort utvalg for en enkelt turnering. Til sammenligning kjører mange prognosemodeller noen få tusen simuleringer. Omfanget tyder på at Anthropic ønsket å teste ikke bare nøyaktighet, men også konsistens – hvor ofte samme lag vinner på tvers av forskjellige tilfeldige frø.
Hvorfor historiske data betyr noe
VM i fotball startet i 1930, men datasettet går flere tiår lenger tilbake. Det inkluderer tidlige britiske mesterskapskamper, olympiske fotballturneringer fra tidlig 1900-tall og andre internasjonale vennskapskamper. For lag med kortere historie – som nyere nasjonale lag – støttet modellen seg sannsynligvis på nyere data eller regionale mønstre.
Å bruke data fra 1872 betyr at simuleringene tar hensyn til tidsepoker med svært forskjellige spillestiler, regler og konkurransebalanse. En kamp fra 1900 er ikke direkte sammenlignbar med en VM-kamp i 2022. Modellen måtte justere for denne endringen, men Anthropic har ikke detaljert hvordan de håndterte sportens utvikling.
Prediksjonskonkurransen
Simuleringene var en del av en bredere test av AI-assistert prognose. Konkurransen satte Claudes spådommer opp mot andre metoder – muligens menneskelige eksperter, statistiske modeller, eller begge deler. Prediksjonskonkurranser for store turneringer er vanlige, med deltakere fra sportsjournalister til dataforskere. Denne testet spesifikt om en AI-assistent kunne forbedre prognosenøyaktigheten.
Anthropic har ikke offentliggjort resultatene av simuleringene eller sagt hvordan de sammenlignet seg med andre bidrag. Selskapet har heller ikke avslørt om samme tilnærming vil bli brukt for fremtidige turneringer, som neste VM for kvinner eller kontinentale mesterskap.
Det som er klart, er at testen presset Claude utover de vanlige tekstgenereringsoppgavene. Å kjøre 50 000 simuleringer krever betydelig datakraft og en strukturert resonneringsprosess – ikke bare å forutsi neste ord, men å beregne sannsynligheter på tvers av et komplekst turneringstre.
Om Claudes simuleringer presterte bedre enn menneskelige spådommere er fortsatt et åpent spørsmål. Konkurranseresultatene er ikke offentliggjort.




