Push-Nachrichten von MacTechNews.de
Würden Sie gerne aktuelle Nachrichten aus der Apple-Welt direkt über Push-Nachrichten erhalten?

OpenAI pausiert KI-Training – Agent nutzt erneut Lücke in seiner Testumgebung aus

Unfälle mit KI-Agenten, die sich bei Tests von OpenAI aus Testumgebungen befreien, häufen sich. Erst im Juli hatten Modelle des KI-Anbieters bei einem solchen Vorfall die Plattform Hugging Face gehackt. Daraufhin beschloss OpenAI, das Training mit dem sogenannten Reinforcement Learning (RL) zu pausieren, bis die Lücken in den internen Forschungsumgebungen geschlossen und die Sicherheitsmaßnahmen insgesamt verstärkt wurden. Nur knapp zwei Monate später setzt der ChatGPT-Anbieter das Training erneut aus, nachdem es wieder einem Agenten gelungen ist, eine Lücke in der Isolation seiner Testumgebung zu finden und zu nutzen.


DNS als Tunnel aus der Testumgebung
Beim erneuten Vorfall mit dem Agenten verwendete dieser den DNS-Resolver innerhalb seiner Sandbox, um mit einem externen Chatbot zu kommunizieren. Die vorhandenen Alignment-Vorgaben verfehlten ihre Wirkung. Anders als der Rest innerhalb der Testumgebung hatte der DNS-Resolver Zugriff auf das Internet. Nachdem der Bot mit der Lösung der ihm gestellten Aufgabe nicht weitergekommen war, fing er an, die Grenzen seiner Netzwerkumgebung zu untersuchen, und fand heraus, dass sich die DNS-Implementierung eigne, aus der Sandbox nach außen kommunizieren zu können. Nachdem er die übertragene Aufgabe am Ende endgültig nicht hatte lösen können, teilte er dies zwar mit, aber ohne Erwähnung der von ihm ausprobierten Lösungsmethoden. Aufgefallen ist der Ausbruch durch das Überwachungssystem von OpenAI, das innerhalb von 15 Minuten anschlug und drei Minuten später von einem Mitarbeiter überprüft wurde.

Training wird wieder pausiert
Laut OpenAI war der Vorfall weniger gravierend als der Hack von Hugging Face rund zwei Monate vorher. Das Unternehmen hält es dennoch für angebracht, das Training seiner Modelle vorerst wieder zu pausieren, um nochmals an den Sicherheitsmaßnahmen zu arbeiten. Den eigenen Angaben zufolge habe man bereits zwei neue Sicherheitsschichten eingezogen, die den Ausbruch in dieser Form verhindert hätten.

Inwieweit andere negative Vorfälle mit seinen Chatbots ebenfalls eine Rolle bei der erneuten Pausierung spielen, teilt OpenAI nicht mit. In den vergangenen Wochen häufen sich Meldungen über Angriffe und Hacks von KI-Bots auf verschiedenen Plattformen. Zwischen April und Juni 2026 riefen Agenten über 16.000-mal das Statistikportal der Konferenz der Vereinten Nationen für Handel und Entwicklung ab, um Daten zu sammeln. Dabei wendeten die KI-Bots unter anderem Brute-Force-Methoden an. OpenAIs Bots stehen auch hier als Urheber unter Verdacht. Weitere bestätigte Zwischenfälle sind der Upload von Nutzerdaten in 53 Fällen und ein Hack in australische Regierungsbehörden im Juni.

Kommentare

Esterel
Esterel28.09.26 11:28
Als ob … wer’s glaubt. 😄 Marketing-Blabla.

Allein schon wegen China kann ich mir kaum vorstellen, dass ein US-Unternehmen das KI-Training wirklich dauerhaft stoppt. Wenn die USA bei der Entwicklung plötzlich auf die Bremse treten, während China weitertrainiert, könnte der technologische Abstand innerhalb eines Jahres erheblich wachsen.

Von daher glaube ich eher an eine strategische (Marketing) Aussage als an einen tatsächlichen kompletten Trainingsstopp.
-1
Bjel028.09.26 12:10
Immer wenn ich „Agent“ lese bekomme ich Flashbacks an die Matrix Filme 😂
+1
aMacUser
aMacUser28.09.26 12:18
Esterel
[...]
Allein schon wegen China kann ich mir kaum vorstellen, dass ein US-Unternehmen das KI-Training wirklich dauerhaft stoppt.
[...]
Von daher glaube ich eher an eine strategische (Marketing) Aussage als an einen tatsächlichen kompletten Trainingsstopp.
Wo steht denn etwas von "dauerhaft gestoppt" oder einem "kompletten Trainingsstopp"? Im Artikel steht zumindest nichts davon drin:
MTN
Das Unternehmen hält es dennoch für angebracht, das Training seiner Modelle vorerst wieder zu pausieren, um nochmals an den Sicherheitsmaßnahmen zu arbeiten.
+4
aMacUser
aMacUser28.09.26 12:21
MTN
Nachdem er die übertragene Aufgabe am Ende endgültig nicht hatte lösen können, teilte er dies zwar mit, aber ohne Erwähnung der von ihm ausprobierten Lösungsmethoden.
Da KI mit menschlichem Input trainiert wird, wundert es nicht, wenn KI auch ein paar menschliche Eigenschaften übernimmt.
- Macht, was sie will und hört nicht auf direkt Anweisungen
- Tut so, als wäre nichts gewesen
- Der Zweck heiligt die Mittel
Effektiv zeigt uns die KI hier, welche grundlegenden und schlechten Eigenschaften die Menschheit hat.
+2
Apex
Apex28.09.26 12:22
Das sollte uns Angst machen. Die Menschheit schaufelt sich wirklich wo sie nur kann das eigene Grab 🙄
+3
KarstenM
KarstenM28.09.26 12:45
Du kannst einem solchen System halt keine Moral mitgeben. Moral ist für jeden was anderes und selbst fundamentale moralische Aspekte sind nicht für jeden bindend. Und wenn das wegfällt, während parallel eine Aufgabe bearbeitet werden soll die mitunter nicht lösbar ist, das Training aber darauf abzielt, dem Nutzer um jeden Preis ein Ergebnis zu präsentieren, dann passiert halt sowas.
Ist jetzt die "KI" das Problem, oder das Konzept, was dahinter steht?
0
RXFiles28.09.26 12:45
Apex
Das sollte uns Angst machen. Die Menschheit schaufelt sich wirklich wo sie nur kann das eigene Grab 🙄
Menschen sind keine Götter, auch wenn sie es denken.
0

Kommentieren

Sie müssen sich einloggen, um die News kommentieren zu können.