Anthropics AI-assistent Claude har kørt 50.000 simulationer af VM med udgangspunkt i kampdata helt tilbage fra 1872. Øvelsen var en del af en test af AI-assisteret forudsigelse i en forudsigelseskonkurrence.
Omfanget af simulationerne
Hver simulation modellerede hele turneringen fra gruppespil til finale og brugte historiske resultater til at informere sandsynligheder. Datasættet dækker mere end 150 års international fodbold, herunder kampe fra den første officielle internationale kamp i 1872 mellem Skotland og England. Claude behandlede disse data for at generere tusindvis af mulige udfald og vægtede faktorer som holdform, indbyrdes kampe og turneringshistorie.
50.000 kørsler er en stor stikprøve for en enkelt turnering. Til sammenligning kører mange forudsigelsesmodeller et par tusinde simulationer. Skalaen antyder, at Anthropic ønskede at teste ikke blot nøjagtighed, men også konsistens – hvor ofte det samme hold vinder på tværs af forskellige tilfældige frø.
Hvorfor de historiske data er vigtige
VM startede selv i 1930, men datasættet går årtier længere tilbage. Det inkluderer tidlige British Home Championship-kampe, olympiske fodboldturneringer fra det tidlige 1900-tal og andre internationale venskabskampe. For hold med kortere historie – som nyere landshold – har modellen sandsynligvis støttet sig på nyere data eller regionale mønstre.
At bruge data fra 1872 betyder, at simulationerne tager højde for epoker med meget forskellige spillestile, regler og konkurrencebalance. En kamp fra 1900 er ikke direkte sammenlignelig med en VM-kamp i 2022. Modellen skulle justere for denne udvikling, selvom Anthropic ikke har detaljeret, hvordan den håndterede sportens foranderlige natur.
Forudsigelseskonkurrencen
Simulationerne var en del af en bredere test af AI-assisteret forudsigelse. Konkurrencen stillede Cludes forudsigelser op mod andre metoder – muligvis menneskelige eksperter, statistiske modeller eller begge dele. Forudsigelseskonkurrencer for store turneringer er almindelige, med deltagere lige fra sportsjournalister til dataforskere. Denne test handlede specifikt om, hvorvidt en AI-assistent kunne forbedre forudsigelsesnøjagtigheden.
Anthropic har ikke offentliggjort resultaterne af simulationerne eller sagt, hvordan de klarede sig i forhold til andre bidrag. Virksomheden har heller ikke oplyst, om samme tilgang vil blive brugt til fremtidige turneringer, som det næste VM for kvinder eller kontinentale mesterskaber.
Det står klart, at testen pressede Claude ud over dens sædvanlige tekstgenereringsopgaver. At køre 50.000 simulationer kræver betydelig regnekraft og en struktureret ræsonneringsproces – ikke blot at forudsige det næste ord, men at beregne sandsynligheder på tværs af et komplekst turneringstræ.
Om Cludes simulationer overgik menneskelige forudsigere, er stadig et åbent spørgsmål. Konkurrencens resultater er ikke blevet offentliggjort.




