Anthropic's AI-assistent Claude heeft 50.000 simulaties van het WK uitgevoerd, gebruikmakend van wedstrijdgegevens die teruggaan tot 1872. De oefening maakte deel uit van een test van AI-ondersteunde voorspellingen in een voorspellingswedstrijd.
De omvang van de simulaties
Elke simulatie modelleerde het volledige toernooi van groepsfase tot finale, waarbij historische resultaten werden gebruikt om kansen te bepalen. De dataset omvat meer dan 150 jaar internationaal voetbal, inclusief wedstrijden uit de eerste officiële interland in 1872 tussen Schotland en Engeland. Claude verwerkte die gegevens om duizenden mogelijke uitkomsten te genereren, waarbij factoren zoals teamvorm, onderlinge resultaten en toernooigeschiedenis werden meegewogen.
Vijftigduizend runs is een grote steekproef voor een enkel toernooi. Ter vergelijking: veel voorspellingsmodellen draaien een paar duizend simulaties. De schaal suggereert dat Anthropic niet alleen nauwkeurigheid wilde testen, maar ook consistentie – hoe vaak hetzelfde team wint over verschillende random seeds.
Waarom historische gegevens belangrijk zijn
Het WK zelf begon pas in 1930, maar de dataset reikt tientallen jaren verder terug. Dat omvat vroege British Home Championship-wedstrijden, Olympische voetbaltoernooien uit het begin van de 20e eeuw en andere interlands. Voor teams met een kortere geschiedenis – zoals nieuwere nationale ploegen – vertrouwde het model waarschijnlijk meer op recente data of regionale patronen.
Het gebruik van data vanaf 1872 betekent dat de simulaties rekening houden met tijdperken met zeer verschillende speelstijlen, regels en concurrentieverhoudingen. Een wedstrijd uit 1900 is niet direct vergelijkbaar met een WK-wedstrijd in 2022. Het model moest die verschuiving corrigeren, hoewel Anthropic niet heeft gedetailleerd hoe het de veranderende aard van de sport heeft aangepakt.
De voorspellingswedstrijd
De simulaties maakten deel uit van een bredere test van AI-ondersteunde voorspellingen. De wedstrijd zette Claude's voorspellingen af tegen andere methoden – mogelijk menselijke experts, statistische modellen, of beide. Voorspellingswedstrijden voor grote toernooien zijn gebruikelijk, met deelnemers variërend van sportjournalisten tot datawetenschappers. Deze specifieke test onderzocht of een AI-assistent de voorspellingsnauwkeurigheid kon verbeteren.
Anthropic heeft de resultaten van de simulaties niet bekendgemaakt, noch hoe ze zich verhielden tot andere inzendingen. Het bedrijf heeft ook niet onthuld of dezelfde aanpak zal worden gebruikt voor toekomstige toernooien, zoals het volgende WK voor vrouwen of continentale kampioenschappen.
Wat duidelijk is, is dat de test Claude verder duwde dan zijn gebruikelijke tekstgeneratietaken. Het draaien van 50.000 simulaties vereist aanzienlijke rekenkracht en een gestructureerd redeneerproces – niet alleen het voorspellen van het volgende woord, maar het berekenen van kansen over een complexe toernooiboom.
Of Claude's simulaties beter presteerden dan menselijke voorspellers blijft een open vraag. De resultaten van de wedstrijd zijn niet openbaar gemaakt.




