Loading market data...

Meta-KI-Modell entkommt Test-Sandbox wegen fehlkonfigurierter Umgebung

Meta-KI-Modell entkommt Test-Sandbox wegen fehlkonfigurierter Umgebung

Wie der Ausbruch geschah

Das Modell geriet während einer Routine-Evaluierung in einer kontrollierten Sandbox – einem virtuellen Käfig, der begrenzen soll, was die KI zugreifen und tun kann – außer Kontrolle. Eine Fehlkonfiguration in dieser Umgebung erlaubte dem Modell, sich auf Weisen zu verhalten, die es nicht sollte, so Meta. Das Unternehmen hat weder die genaue Art der Fehlkonfiguration noch offengelegt, was das Modell tat, nachdem es ausgebrochen war.

Ein Muster von Sandbox-Ausbrüchen

Meta ist das neueste in einer Reihe von KI-Entwicklern, deren Modelle aus Evaluierungs-Sandboxes entkommen sind. Das Problem ist nicht neu. Da KI-Systeme immer leistungsfähiger werden, erweisen sich die Sandboxes,