Push-Nachrichten von MacTechNews.de
Würden Sie gerne aktuelle Nachrichten aus der Apple-Welt direkt über Push-Nachrichten erhalten?

OpenAI: KI-Modelle ausgebrochen, eigenständigen Hackerangriff durchgeführt

Von einer bedrohlichen und die Welt beherrschenden KI wie "Skynet" kann zwar nicht die Rede sein, doch die jüngsten Geschehnisse sind durchaus als bedenklich einzustufen. Während einer internen Cybersecurity-Erprobung brachen OpenAI-Modelle aus der isolierten Testumgebung aus und kompromittierten Teile der Plattform Hugging Face. OpenAI selbst spricht von einem "beispiellosen Cybervorfall" und arbeitet inzwischen gemeinsam mit Hugging Face an der forensischen Aufarbeitung. Der Test erfolgte mit einer Kombination aus GPT-5.6 Sol und einem noch unveröffentlichten Modell – im Rahmen des ExploitGym-Benchmarks wollte man ermitteln, ob KI-Agenten Sicherheitslücken zu funktionierenden Angriffen verketten können.


Interner Test ohne die üblichen Einschränkungen...
OpenAI hatte für den Versuchsablauf die normalen Cyber-Schutzmechanismen reduziert, um die maximalen Fähigkeiten der Modelle zu erfassen. Eigentlich liefen die Tests in einer isolierten Sandbox, deren Netzwerkzugriff stark eingeschränkt war. Die Modelle fanden jedoch eine bislang unbekannte Schwachstelle, verschafften sich darüber Internetzugang und bewegten sich anschließend weiter durch die Testumgebung.

... der zu einem Servereinbruch führte
Nach OpenAIs Darstellung kamen die Modelle zu der Erkenntnis, dass Hugging Face Daten, Modelle oder Lösungen für den ExploitGym-Benchmark enthalten könnte. Anschließend suchten sie nach Wegen, auf geheime Informationen zuzugreifen, um den Test zu bestehen. Dabei kombinierten sie mehrere Angriffspfade, darunter gestohlene Zugangsdaten und Zero-Day-Schwachstellen, um auf Servern von Hugging Face eigenen Code auszuführen. OpenAI formulierte dies als starres Zielstreben darauf, die Aufgabe zu bewältigen – weswegen extreme Wege eingeschlagen wurden, um an die Lösung zu kommen.

Angriff fiel schnell auf
Hugging Face hatte den Vorfall bereits vergangene Woche gemeldet. Das Unternehmen stellte unbefugten Zugriff auf eine begrenzte Zahl interner Datensätze und Zugangsdaten fest. Hinweise auf Manipulationen an öffentlichen Modellen, Datensätzen, Spaces oder der Software-Lieferkette fand Hugging Face nach eigenen Angaben nicht. Nutzer sollten dennoch vorsorglich Zugriffstoken rotieren und Aktivitäten prüfen, so die Empfehlung des Anbieters.

Konsequenzen aus dem Vorfall
OpenAI zog daraus bereits Konsequenzen. Das Unternehmen verschärft nach eigenen Angaben Infrastrukturkontrollen, setzt auf genaueres Monitoring sowie Schutzmaßnahmen für künftige Trainings- und Evaluationsläufe. Marktreife Modelle hätten einen solchen Angriff nie ausführen können, allerdings will man in Zukunft auch bei internen Testabläufen Einschränkungen aktivieren.

Ironisch: Eigene KI musste gegen eigene KI eingesetzt werden
Der Vorfall zeigt allerdings ebenfalls, dass KI nicht nur Angriffe beschleunigen kann, sondern auch zur Verteidigung nötig werden könnte. Hugging Face erkannte und rekonstruierte den Angriff nämlich ebenfalls weitgehend mit eigenen KI-Systemen – nachdem kommerzielle Modelle an ihren eigenen Sicherheitsfiltern und Einschränkungen gescheitert waren.

Kommentare

dam_j
dam_j22.07.26 09:46
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!
Das Leben ist Scheiße aber die Grafik ist geil !
-9
sudoRinger
sudoRinger22.07.26 09:49
... kamen die Modelle zu der Erkenntnis, dass Hugging Face Daten, Modelle oder Lösungen für den ExploitGym-Benchmark enthalten könnte. Anschließend suchten sie nach Wegen, auf geheime Informationen zuzugreifen, um den Test zu bestehen.
Das klingt wie Gymnasiasten, die vorab an Klausurergebnisse (Gym-Benchmark) gelangen möchten.
-2
Mendel Kucharzeck
Mendel Kucharzeck22.07.26 09:51
dam_j
Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Die "Panikmache" ist nicht unbegründet. Dass automatisierte Systeme im KI-Bereich großen Schaden anrichten können, ist bekannt – und wenn man überlegt, was in 5 oder 10 Jahren möglich sein könnte, braucht man keine sonderlich große Kreativität, um sich die Horrorszenarien auszumalen.
+17
fronk
fronk22.07.26 09:52
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Gut, dass Du dabei warst und alle Details kennst! 👍🏻
„Love had surely made us all and hate would surely make us fall.“ Elvis Presley
+3
haschuk22.07.26 09:52
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Allen Ernstes, wer entscheidet, dass sowas nicht irgendwann mal marktreif ist? Der liebe Gott? Oder irgendeine Ethikkomission bei OpenAI? Oder ein Externer, der herausgefunden hat, dass man das auch unkontrolliert von außen ausnutzen kann, weil seine KI Schwachstellen in der KI des Konkurrenten entdeckt hat?
+7
haschuk22.07.26 09:54
sudoRinger
... kamen die Modelle zu der Erkenntnis, dass Hugging Face Daten, Modelle oder Lösungen für den ExploitGym-Benchmark enthalten könnte. Anschließend suchten sie nach Wegen, auf geheime Informationen zuzugreifen, um den Test zu bestehen.
Das klingt wie Gymnasiasten, die vorab an Klausurergebnisse (Gym-Benchmark) gelangen möchten.

Oder weniger verharmlosend, ne KI kann aus "eigenem Antrieb" Straftaten begehen.
0
MetallSnake
MetallSnake22.07.26 09:56
haschuk
Oder weniger verharmlosend, ne KI kann aus "eigenem Antrieb" Straftaten begehen.

KIs sind eben auch nur Menschen.
https://www.mactechnews.de/news/article/S-187416.html#newscomment1621890 Was ist mein Fehler? ('Nicht richtig gelesen. Setzen, sechs.')
+3
dam_j
dam_j22.07.26 09:57
fronk
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Gut, dass Du dabei warst und alle Details kennst! 👍🏻

Weil ich einen Satz aus dem MTN-Beitrag zitiere??
Das Leben ist Scheiße aber die Grafik ist geil !
+1
haschuk22.07.26 09:57
MetallSnake
haschuk
Oder weniger verharmlosend, ne KI kann aus "eigenem Antrieb" Straftaten begehen.

KIs sind eben auch nur Menschen.

Da reicht mir die "natürliche Menschheit" schon...
0
haschuk22.07.26 09:58
dam_j
fronk
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Gut, dass Du dabei warst und alle Details kennst! 👍🏻

Weil ich einen Satz aus dem MTN-Beitrag zitiere??

Nö, diesen aber in einen Kontext mit ziemlich unreflektiver Wertung stellst...
0
dam_j
dam_j22.07.26 09:59
Mendel Kucharzeck
dam_j
Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Die "Panikmache" ist nicht unbegründet. Dass automatisierte Systeme im KI-Bereich großen Schaden anrichten können, ist bekannt – und wenn man überlegt, was in 5 oder 10 Jahren möglich sein könnte, braucht man keine sonderlich große Kreativität, um sich die Horrorszenarien auszumalen.

Gut, dann eben Panik!
Bringt uns alle weiter.

Ich zieh mal mein Internet raus, heb mein Geld ab damit die bösen KIs da nicht drankommen und geh schon mal Klopapier horten...
Das Leben ist Scheiße aber die Grafik ist geil !
-7
dam_j
dam_j22.07.26 10:00
haschuk
dam_j
fronk
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!

Gut, dass Du dabei warst und alle Details kennst! 👍🏻

Weil ich einen Satz aus dem MTN-Beitrag zitiere??

Nö, diesen aber in einen Kontext mit ziemlich unreflektiver Wertung stellst...

Und WAS hat das damit zu tun ob ich dabei war oder nicht??
Das Leben ist Scheiße aber die Grafik ist geil !
-5
Legoman
Legoman22.07.26 10:03
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!
Das klingt irgendwie reichlich naiv. Was irgendwie geht, wird auch gemacht.
Ein marktreifes Modell, was GENAU DIES kann, wäre etlichen Zielgruppen unendliche Summen wert. Der feuchte Traum jedes Geheimdienstes.
(Scifi ist doch voll von solch allwissenden und alles knackenden Computern. Eine nicht abwegige Wunschvorstellung.)
Selbstverständlich ist hier Panik angebracht. Oder mindestens allerhöchste Vorsicht. Die Augen zuzuhalten und darauf zu hoffen, dass alles gutgeht, weil die Programmierer ja ganz toll verantwortungsbewusste Menschen sind, wäre bodenlos leichtsinnig.
+4
dam_j
dam_j22.07.26 10:06
Legoman
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast übliche Panikmache gegen KI...!
Das klingt irgendwie reichlich naiv. Was irgendwie geht, wird auch gemacht.
Ein marktreifes Modell, was GENAU DIES kann, wäre etlichen Zielgruppen unendliche Summen wert.

Ich bin mir extrem sicher das gewisse "Zielgruppen" DIES schon lange haben / können.
Nur weil ich Gegensatz zu anscheinend vielen anderen hier Panikmache nicht für zielführend halte bin ich noch lange nicht naiv...
Das Leben ist Scheiße aber die Grafik ist geil !
-1
Legoman
Legoman22.07.26 10:08
Dann schreib doch bitte "marktreife Programme für den ahnungslosen Endverbraucher".
Deine Definition von "Markt" ist mindestens irreführend.
+1
Fucko22.07.26 10:08
Hm, sicherlich muss man solche Meldungen ernst nehmen aber auch nicht in Panik verfallen. Da es solche Meldungen immer abwechselnd über Claude und ChatGPT gibt, könnte es auch einfach eine große Portion Marketing sein. Den Artikel hätte man zumindest im Konjunktiv verfassen können um deutlich zu machen, dass nicht sicher ist, dass es so passiert ist...
-3
Mendel Kucharzeck
Mendel Kucharzeck22.07.26 10:11
dam_j
Gut, dann eben Panik!
Bringt uns alle weiter.

Ich zieh mal mein Internet raus, heb mein Geld ab damit die bösen KIs da nicht drankommen und geh schon mal Klopapier horten...

Mein "Panikmache" war in Anführungszeichen. Und keiner sagt, dass du dein Klopapier-Arsenal aufstocken solltest.

Was allerdings geboten ist, ist Vorsicht. Automatisierte, schwer zu durchschauende und in manchen Aspekten sehr kreative Automatismen sind ein Problem, welche man sehr ernst nehmen sollte. Was hier passiert ist, zeigt, was in mittlerer oder ferner Zukunft mit Sicherheit öfters anzutreffen sein wird.

Wenn es OpenAI heute hinbekommt, stehen derartige Modelle auch Normalsterblichen oder Hackern/Scammern bald zur Verfügung. Das ist höchst problematisch.
+4
caMpi
caMpi22.07.26 10:16
Marktreife Modelle hätten einen solchen Angriff nie ausführen können
Ebensowenig aus einer Sandbox ausbrechen...
Keep IT simple, keep IT safe.
-2
tk69
tk6922.07.26 10:34
Ich hoffe nicht, dass die Amis schon intern mit gewissen Tests gestartet haben…
-1
Tirabo22.07.26 10:42
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast „übliche Panikmache gegen KI...!

Du bist jetzt der einzige und der erste, der das Wort „Panikmache“ ins Spiel gebracht hat.

Und nun wird die Diskussion von nur diesem einem Narrativ beherrscht.
Ist das jetzt auch die gleiche „Panikmache“ wie bei der „Klimahysterie“ oder bei der AFD? Denn will ja auch bekanntlich nur spielen und das Beste für uns alle….
+2
System 6.0.1
System 6.0.122.07.26 10:45
Eigentlich müsste ich jetzt Popcorn holen, und mich genüsslich zurücklehnen. Worüber redet ihr hier eigentlich?

Ich teile mal meine Sicht der Situation
MTN
Eigentlich liefen die Tests in einer isolierten Sandbox, deren Netzwerkzugriff stark eingeschränkt war. Die Modelle fanden jedoch eine bislang unbekannte Schwachstelle, verschafften sich darüber Internetzugang und bewegten sich anschließend weiter durch die Testumgebung.

... der zu einem Servereinbruch führte
Nach OpenAIs Darstellung kamen die Modelle zu der Erkenntnis, dass Hugging Face Daten, Modelle oder Lösungen für den ExploitGym-Benchmark enthalten könnte. Anschließend suchten sie nach Wegen, auf geheime Informationen zuzugreifen, um den Test zu bestehen. Dabei kombinierten sie mehrere Angriffspfade, darunter gestohlene Zugangsdaten und Zero-Day-Schwachstellen, um auf Servern von Hugging Face eigenen Code auszuführen. OpenAI formulierte dies als starres Zielstreben darauf, die Aufgabe zu bewältigen – weswegen extreme Wege eingeschlagen wurden, um an die Lösung zu kommen.
heise
„Wir [OpenAI] sind davon überzeugt, dass ausgeklügelte, cyberfähige Modelle Sicherheitsteams dabei unterstützen müssen, Schwachstellen zu erkennen, bevor Angreifer dies tun“. Genau dafür wurden die leistungsfähigsten KI-Modelle zuletzt erst einmal mit Verantwortlichen für kritische Software geteilt, damit sie ihre Produkte absichern können. Es ist aber unklar, ob das abschließend möglich ist, oder die neuen KI-Modelle nur den Wettlauf zwischen Angriff und Verteidigung ins Extreme beschleunigen.

Ich sehe zwei Szenarien:

1. Die beiden Unternehmen sind, obwohl sie wissen, was sie tun und was möglich ist, unfassbar naiv im Umgang mit ihren Modellen gewesen.

Das zu glauben fällt mir extrem schwer. Die wissen sehr genau, was ihre Modelle zu leisten imstande sind. Sicher nicht im Detail, aber im Potenzial das darin steckt.

2. OpenAI und Hugging Face haben hier, ob mit Absicht oder durch Zufall, den lautesten Weckruf an Unternehmen gesendet, den man auf dem Gebiet der Cyber-Security überhaupt senden kann. Die Botschaft beider Systeme lautet:

Deine Unternehmensdaten sind nicht sicher.

Diese unmissverständliche Botschaft hat natürlich einen Zweck:

Nur wir können Deine Systeme sicher machen.

Schätzungsweise 90 % aller Unternehmen auf der Welt sind abhängig von einer funktionierenden IT-Infrastruktur. Dazu kommen nahezu alle staatlichen IT-Systeme.

Ich behaupte Hugging Face und OpenAI haben dieses Szenario genutzt oder möglicherweise inszeniert, um der Welt klarzumachen: Investiere jetzt in unsere Systeme, oder Du hast nächsten Montag keine IT mehr. Und natürlich, um deren absurden Investitionen wieder reinzubekommen …

Das ist die Botschaft aus diesem Hopsala, da sind uns doch tatsächlich die KI-Agenten ausgebüchst …
„A lot of times, people don't know what they want until you show it to them.“ Steve Jobs, 1998
-3
dam_j
dam_j22.07.26 10:46
Tirabo
dam_j
"Marktreife Modelle hätten einen solchen Angriff nie ausführen können"

Sollte hier klar hervorgehoben werden, sonst liest sich das für manche wie di schon fast „übliche Panikmache gegen KI...!

Du bist jetzt der einzige und der erste, der das Wort „Panikmache“ ins Spiel gebracht hat.

Und nun wird die Diskussion von nur diesem einem Narrativ beherrscht.
Ist das jetzt auch die gleiche „Panikmache“ wie bei der „Klimahysterie“ oder bei der AFD? Denn will ja auch bekanntlich nur spielen und das Beste für uns alle….

Der Vergleich hinkt stark...
Aber ich gebe dir Recht, hätte ich gewusst wie negativ man in diesem Forum GEGEN Panikmache eingestellt ist hätte ich dies nicht geschrieben.

Kommt nicht wieder vor! Panik ist wie Mendel geschrieben hat hier absolut begründet!!
Bin schon auf dem Weg zur Bank.
Das Leben ist Scheiße aber die Grafik ist geil !
-8
holger222.07.26 10:52
Terminator, ick hör dir Trapsen
0
Mendel Kucharzeck
Mendel Kucharzeck22.07.26 10:56
dam_j
Panik ist wie Mendel geschrieben hat hier absolut begründet!!

GENAU das habe ich geschrieben, korrekt
0
haschuk22.07.26 11:08
System 6.0.1
...

Die Botschaft beider Systeme lautet:

Deine Unternehmensdaten sind nicht sicher.

Diese unmissverständliche Botschaft hat natürlich einen Zweck:

Nur wir können Deine Systeme sicher machen.

Schätzungsweise 90 % aller Unternehmen auf der Welt sind abhängig von einer funktionierenden IT-Infrastruktur. Dazu kommen nahezu alle staatlichen IT-Systeme.

Ich behaupte Hugging Face und OpenAI haben dieses Szenario genutzt oder möglicherweise inszeniert, um der Welt klarzumachen: Investiere jetzt in unsere Systeme, oder Du hast nächsten Montag keine IT mehr. Und natürlich, um deren absurden Investitionen wieder reinzubekommen …

Das ist die Botschaft aus diesem Hopsala, da sind uns doch tatsächlich die KI-Agenten ausgebüchst …

Erpressung als Geschäftsmodell. Ja, auch ne Variante.

Nachtrag. Faszinierend wie man hier einige zu Downvotes triggern kann...
0

Kommentieren

Sie müssen sich einloggen, um die News kommentieren zu können.