OpenAI heeft een reeks cyberveiligheidsincidenten onthuld die zich voordeden tijdens evaluaties door derden van zijn AI-systemen. Het bedrijf schrijft de incidenten toe aan twee factoren: de toenemende mogelijkheden van zijn AI en verkeerde configuraties in de testomgeving.
Wat de onthulling zegt
De onthulling, die door het bedrijf openbaar is gemaakt, bevestigt dat er incidenten plaatsvonden terwijl externe partijen de technologie van OpenAI evalueerden. Het bedrijf gaf geen details over de aard van de incidenten, het aantal getroffen systemen of de tijdlijn van de gebeurtenissen. Wat duidelijk is, is dat de incidenten plaatsvonden in de context van beoordelingen door derden, een gangbare praktijk voor het testen van AI-modellen voordat ze worden vrijgegeven.
De verklaring van OpenAI is kort over details. Het zegt niet of de incidenten te maken hadden met datalekken, systeemstoringen of iets anders. Het noemt ook geen namen van de externe evaluatoren of wanneer de incidenten plaatsvonden. De formulering van het bedrijf suggereert dat de incidenten ernstig genoeg waren om openbaarmaking te rechtvaardigen, maar het blijft steken bij het uitleggen van de volledige impact.
Twee triggers
Het bedrijf wees op twee oorzaken. Ten eerste de toenemende mogelijkheden van de AI zelf. Naarmate modellen krachtiger worden, kunnen ze zich op onvoorspelbare manieren gedragen, waardoor mogelijk kwetsbaarheden tijdens het testen worden blootgelegd. Ten tweede verkeerde configuraties in het testproces. Dit zijn fouten in de opzet van de evaluatieomgeving, die openingen kunnen hebben gecreëerd waardoor de incidenten konden plaatsvinden. De combinatie van deze twee factoren leidde volgens de onthulling tot de beveiligingsinbreuken.
Die combinatie is niet moeilijk voor te stellen. Een capabelere AI zou kunnen reageren op een slecht geconfigureerde testopstelling op manieren die de ontwikkelaars niet hadden voorzien. Een verkeerd geconfigureerde omgeving kan ook toegangspunten open laten die er niet zouden moeten zijn. Hoe dan ook, de onthulling maakt duidelijk dat de incidenten niet het gevolg waren van een enkele fout, maar van een samenloop van twee afzonderlijke problemen.
Onbeantwoorde vragen
De onthulling laat veel vragen onbeantwoord. OpenAI heeft niet gezegd of de incidenten hebben geleid tot gegevensverlies, of er gegevens van derden zijn blootgesteld, of welke wijzigingen het zal aanbrengen in zijn evaluatieprocedures. Het bedrijf heeft ook niet verduidelijkt of de incidenten zijn opgelost en welke stappen zijn ondernomen om soortgelijke gebeurtenissen te voorkomen. Voorlopig dient de onthulling als een herinnering dat zelfs de meest geavanceerde AI-systemen niet immuun zijn voor beveiligingsfouten, vooral wanneer ze worden getest onder realistische omstandigheden.
Het besluit van OpenAI om deze informatie openbaar te maken is opmerkelijk, maar het is ook een startpunt. Het bedrijf heeft geen tijdlijn gegeven voor verdere updates, en het is onduidelijk of het meer details zal vrijgeven. Tot die tijd blijft de exacte aard van deze incidenten onbekend.



