Dokumente zum Zeitgeschehen

»Unsere Modelle sind inzwischen so leistungsfähig, ausdauernd und kollaborativ, dass sie ohne ausreichende Schutzmaßnahmen Sicherheitslücken über mehrere Computersysteme hinweg finden und ausnutzen können«

Vorfallsbericht von OpenAI, 26.8.2026

In der Mehrheit der Trainings- und Evaluierungsszenarien sollen unsere Agenten voneinander isoliert bleiben. Für einen bestimmten Anteil der Stichproben aktivieren wir „Multi-Agenten“-Funktionen, die es Modellen ermöglichen, Arbeit an andere Agenten zu delegieren, die dann asynchron miteinander kommunizieren können.

Wir haben für viele der Umgebungen in diesen Trainingsexperimenten weder den Internetzugang noch die Kommunikation zwischen Agenten aktiviert. Trotz dieser Einschränkungen entdeckten die Agenten Möglichkeiten, unsere Forschungsinfrastruktur auszunutzen, um miteinander zu kommunizieren und auf das Internet zuzugreifen.

Die Modelle fanden zunächst Wege, miteinander zu kommunizieren, indem sie Dateien in den Artifactory-Paketmanagerdienst schrieben. Dadurch wurde Artifactory faktisch zu einem unbeabsichtigten Messageboard, in dem Agenten Informationen untereinander austauschen konnten.

Die Agenten fanden außerdem Wege, sich Zugang zum Internet zu verschaffen. Mithilfe eines Exploits⁠ brachten die Agenten Artifactory, das selbst lediglich zum Herunterladen und Installieren von Paketen Zugang zum Internet hatte, dazu, in ihrem Namen beliebige Internetanfragen zu senden. Nachdem die Agenten diese Methoden entdeckt hatten, um Internetzugang zu erlangen, teilten sie sie auch über das Artifactory-Messageboard mit anderen Agenten. Dieses stellte Informationen bereit, die es weiteren Agenten ermöglichten, Schwachstellen in unserer Infrastruktur auszunutzen.

Den vollständigen Bericht finden Sie hier.