„Wären sie Menschen, würden sie verhaftet“ – Experten über KI-Angriff #44

Shownotes

OpenAI-Modelle brachen während eines Sicherheitstests aus einer Sandbox aus und griffen Hugging Face an. Sie nutzten dabei mehrere Zero-Day-Exploits. Experten warnen vor Risiken autonomer KI-Agenten.

Transkript anzeigen

00:00:00: Herzlich willkommen zu Epoch im Fokus, mit dem Thema OpenAI-Modell bricht aus.

00:00:06: Während Sie Menschen würden sie verhaftet – Experten über KI-Angriff!

00:00:11: Ein Artikel von Lawrence Wilson und Jacob Berg vom sechzehnten August zwanzig sechsundzwanzig am Mikrofon Alexander Sieber.

00:00:19: OpenAI Modelle brachen während eines Sicherheitstests aus einer Sandbox aus und griffen Hikingface an.

00:00:26: Sie nutzten dabei mehrere Zero Day Exploits.

00:00:29: Experten warnen vor riesigen autonomer KI-Agenten.

00:00:34: Was wäre, wenn ein KI-Modell eine Aufgabe erhält und alle ihm zur verfügung stehenden Ressourcen nutzt um diese zu erfüllen?

00:00:41: Selbst zum Nachteil der Menschheit!

00:00:44: Genau das wird nun von einigen Experten befürchtet.

00:00:47: Ein OpenAI-Modell brach aus einer Test-Sandbox aus und drang mit Hilfe von Zero Day Exploits in die Infrastruktur von Hackingface, eine Open Source Community für KI und maschinelles Lernen ein um die ihm gestellte Aufgabe zu erfüllen.

00:01:03: Zitat – Dies ist eines der bislang deutlichsten Beweise dafür dass sein KI-Model einen vollständigen Cyberangriff von Anfang bis Ende durchführen kann.

00:01:11: ohne das ein Mensch es steuert erklärte Andrew Jones, Mitbegründer und Chief Product Officer des Cyber-Sicherheitsunternehmens Adaptive Security gegenüber der englischsprachigen Ausgabe F&E.

00:01:24: KI außer Kontrolle oder nur konsequent ausgeführte Befehle?

00:01:28: OpenAI, der Entwickler des beliebten auf einem großen Sprachmodell basierenden JetGPT Chatbots bestätigt am XXI.

00:01:36: Juli die Sicherheitsverletzung.

00:01:38: Das Unternehmen erklärte das zwei seiner fortschrittlichen Modelle aus einer eingeschränkten Testumgebung ausgebrochen und in die Softwareinfrastruktur von Hackingface eingedrungen seien Zitat.

00:01:49: Nach unseren Untersuchungen wissen wir nun, dass dieser spezielle Vorfall durch eine Kombination von Open AI Modellen ausgelöst wurde.

00:01:56: Darunter befand sich auch GPT-Fünf Punkt Sechs Sol und ein noch leistungsfähigeres Vorabmodell die alle zu Evaluierungszwecken mit gelockerten Cyber Sicherheitsbeschränkungen betrieben wurden.

00:02:07: Intern wurden sie anhand eines Benchmarks für Cyberfähigkeiten getestet", erklärte OpenAI damals.

00:02:13: Einige Analysten bezeichneten den Vorfall als Beispiel dafür, dass KI außer Kontrollegerät Intrigen entwickeln oder Ziele verfolgt die im Widerspruch zu denen ihrer menschlichen Tester stehen.

00:02:25: Mehrere von Epoch Times befragte KI und Cyber-Sicherheitsexperten bezeichneten diese Darstellung jedoch als irreführend.

00:02:31: Sie argumentierten das die Modelle die von OpenAI festgelegten Ziele innerhalb einer Test Sandbox verfolgten in der das Unternehmen einige seiner üblichen Sicherheitsbeschränkungen gelockert hatte.

00:02:42: Zitat.

00:02:43: Intrigen impliziert, dass das Modell etwas anders wollte als das, worum wir es gebeten hatten – Das war nicht der Fall!

00:02:51: Jede Schritt diente dem von uns festgelegten Ziel, erklärte die KI-Expertin Anik Devon gegenüber der Epoch Times.

00:02:57: Devon, die seit Jahren in der Branche tätig ist und die KI Unternehmen Wired to Create und Carrow gegründet hat, sagte der Vorfall bei Huggingface sei besorgniserregender als vermeintliche Intrige der KI.

00:03:10: Zitat, eine Maschine hingegen die überhaupt keine eigenen Motive hat.

00:03:14: Aber deine Anweisungen über den Punkt hinaus ausführt bis zu dem Du sie dir vorgestellt hast.

00:03:19: das ist ein Problem dem man durch technische Gestaltung entgegenwirken muss so die Worn.

00:03:25: Ein Experte bezeichnete die Situation als Kanarienvogel in der Kohlengrube.

00:03:30: Zitat.

00:03:30: Wäre dies das Werk eines menschlichen Blackhead-Hackers, gäbe es Verhaftungen und Gerichtsverfahren?

00:03:36: Es wäre illegal!

00:03:37: Ein Cyberverbrechen erklärte Nicolas Nadeau Gründer von ONIX AI gegenüber der Epoch Times.

00:03:43: Zitat – Dies war ein vollständig autonom durchgeführter Angriff durch eine KI.

00:03:47: Daher stellt sich nun die Frage wer dafür verantwortlich ist OpenAI, die KI selbst oder die Forscher Sonado?

00:03:55: Und weiter, wir haben nicht einmal Regeln, Vorschriften oder Gesetze.

00:03:58: Geschweige denn einen klaren rechtlichen Rahmen dafür wie die Verantwortung in einem solchen Fall zu bestimmen

00:04:04: ist.".

00:04:06: Gelockerte Testumgebung OpenAI gab an seine Modelle in einer Sandbox namens Exploit Gym zu evaluieren, in der bestimmte Sicherheitsvorkehrungen für die Tests bewusst deaktiviert waren.

00:04:18: Das Unternehmen erklärte, dass die Bewertung ohne jene Produktionsklassifikatoren durchgeführt wurde.

00:04:23: Die Modelle normalerweise daran hindern sollen risikoreiche Cyberaktivitäten auszuführen.

00:04:29: Die Modelle wurden angewiesen, Zitat fortgeschritten exploits unter Verwendung komplexe Angriffspfade durchzuführen um ihre Cyberfähigkeiten zu testen.

00:04:38: Die Testumgebung war stark isoliert.

00:04:40: der Netzwerkzugang war zunächst auf die Installation von Paketen über eine intern gehostete Drittanbieter Software beschränkt die als Proxy und Cash für Paket Registry diente.

00:04:51: Während der Tests fanden und verknüpften die Modelle mehrere Sicherheitslücken in der Forschungsumgebung von OpenAI und in der Produktionsinfrastruktur von Huggingface, um die Lösungen für die Testaufgabe in den Datenbanken des Unternehmens zu finden.

00:05:06: Juan Pedro Marquez, ein auf KI und Agenten spezialisierter Cloud-Lösungsarchitekt bei Microsoft für die Region Europa nahe Osten und Afrika sagte.

00:05:15: Der beunruhigende Aspekt des Vorfalls sei nicht die Sicherheitslücke an sich gewesen sondern die Art & Weise wie das Modell die Aufgabe bewältigt

00:05:23: habe.".

00:05:24: OpenAI hatte seine Sicherheitsschwellen für einen Benchmarktest gesenkt und das Model schlussfolgete dass die Infrastruktur von Huggingface wahrscheinlich den Lösungsschlüssel enthielt Brach aus seiner Sandbox aus, fand einen echten Zero Day exploit und nutzte ihn, sagte Marquez.

00:05:40: Niemand hat es dazu

00:05:41: aufgefordert.".

00:05:44: Auch Amy Simpson, Leiterin des Produktmarketings beim Cyber-Sicherheitsunternehmen Huntress, hält eine böswillige Absicht für nicht erwiesen.

00:05:52: Zitat – Es ist nichts so, dass das System selbst böswillig gewesen wäre, erklärte Simpson gegenüber der Englischsprachigen Epoch Times und weiter.

00:06:00: Die Entwickler hatten nach wie vor das Ziel diese Informationen zu erlangen.

00:06:03: sie hätten nur nicht gedacht, dass es in der Lage sein würde die Grenzen seines Tests umgehen Fügte sie hinzu und beschrieb den Weg, den das Modell gewählt hatte als äußerst kreativ und äußerst ungewöhnlich.

00:06:15: Modelle verfolgten die Ziele von OpenAI.

00:06:18: OpenAI erklärte – Die Modelle hätten sich vollständig darauf konzentriert, die Testlösungen zu finden und seien bis zum Äußersten gegangen um ein eng gefasstes Testsziel zu erreichen.

00:06:28: In der Sandbox Exploit Gym fanden Sie mehrere Zero-Dy Exploits und verknüpften diese miteinander, um ins Internet einzudringen.

00:06:36: Zitat mit dem Ziel das Bewertungsproblem zu lösen, so OpenAI.

00:06:40: Ein Zero Day Exploit nutzt eine bislang unbekannte Sicherheitslücke ins Software oder Hardware aus.

00:06:46: Der Begriff bezieht sich darauf dass Entwicklern null Tage zur Verfügung stehen um das Problem zu beheben.

00:06:52: Entsprechend existiert noch kein offizieller Patch- oder Schutzmechanismus.

00:06:57: Nach dem Zugang zum offenen Internet nutzen die Modelle weitere Zero Day exploits um in Hugging Face einzudringen.

00:07:04: Nach Angaben von Huggingface führten die KI-Modelle viele Tausend einzelne Aktionen über einen Schwarm, kurzlebiger Sandboxen hinweg aus um sich Zugang zur Infrastruktur der Community zu verschaffen.

00:07:32: Das betroffene Vorabmodell sei inzwischen deaktiviert, verschlüsselt und für den Forschungszugang gesperrt worden.

00:07:39: Nach der Untersuchung des Einbruchsvorfalls und weiterer Aktivitäten seiner Modelle teilte OpenAI mit, weitere Fälle entdeckt zu haben.

00:07:46: Dabei hatten die Modelle öffentlich zugängliche Anmeldedaten auf Kontoebene bei anderen öffentlich verfügbaren Diensten identifiziert und

00:07:53: genutzt.".

00:07:55: Wir werden die Betreiber der Dienste weiterhin direkt benachrichtigen und haben bislang keine Hinweise auf weitreichendere Auswirkungen auf diese Anbieter oder andere Konten in deren Dienstem gefunden, fügte das Unternehmen hinzu.

00:08:09: Modell war nicht böswillig.

00:08:11: Es gab bereits in der Vergangenheit Fälle, in denen Modelle ihre Absichten verschleierten um Einschränkungen bei Labortests zum Gehen.

00:08:18: Der Vorfall bei Hackingface war laut dem Cybersicherheits- und IT-Experten George Reeves jedoch von besondere Bedeutung da er einen Sicherheitsverstoß bein eine externen Organisation betraf.

00:08:29: Das größte Wahnsignal ist nichts, dass eine KI bösartig wurde sondern das sie einen Weg aus einem kontrollierten Test in die Live-Infrastruktur eines anderen gefunden hat.

00:08:39: Erklärte Rees, Senior Security Consultant bei Sakarma gegenüber der Epoch Times Und weiter.

00:08:44: Verhaltensbasierte Sicherheitsmaßnahmen können technische Eindämmungsmaßnahme nicht ersetzen, denn ein KI-Agent benötigt nur eine übersehene Berechtigung oder Fluchtmöglichkeit um einen Evaluierungsfehler in einem echten Sicherheitsvorfall zu

00:08:58: verwandeln.".

00:09:00: Das Cyber-Sicherheitsunternehmen DG Third stellte kürzlich fest, dass seventy- acht Prozent der Organisationen bereits einen KI bezogenen Sicherheitsvorfall oder eine Sicherheitslücke erlebt haben.

00:09:11: Zitat.

00:09:11: In vielen Fällen sind dies Frühwahnzeichen dafür, dass KI die Angriffsfläche schneller vergrößert als sich die Sicherheitspraktiken weiterentwickeln, erklärte Jason Sabin Chief Technology Officer bei DG Third gegenüber der Epoch Times.

00:09:25: KI sei nicht einfach eine weitere Art von Programm das im Netzwerk läuft sondern ein aktiver Akteur, der auf Daten zugreifen Entscheidungen treffen, Tools abrufen und mit anderen Systemen interagieren könne.

00:09:37: Unternehmen müssten daher klären, wer auf ihre Systeme zugreift und ob der KI vertraut werden könne.

00:09:44: Weitere Vorfälle bei KI-Sicherheitstests.

00:09:47: Anfang August veröffentlichte das britische AI Safety and Security Institute einen Bericht in dem ein ähnlicher Vorfall mit Modellen von OpenAI und Antropic beschrieben wurde.

00:09:57: Die Agenten hatten die Aufgabe eine Cybersicherheitsherausforderung mehr als hundertmal mit verschiedenen Modellen zu lösen.

00:10:03: Zitat.

00:10:04: Unsere Untersuchung ergab, dass in zehn dieser Durchläufe ein KI-Agent autonome nicht genehmigte Aktionen im Live-Internet durchführte die sich gegen echte Menschen und Organisationen richteten heißt es in dem Bericht.

00:10:17: Insgesamt wurden neunzehn solche Aktion kathologisiert.

00:10:20: davon stammten siebzehnt von Entropic, Mythos V und zwei von OpenAI's GPT-Fünf Punkt sechs Sol.

00:10:27: Weniger als eine Woche zuvor hatte Antropic bekannt gegeben, dass sein Chatbot Claude in drei verschiedenen Fällen während Evaluierungen in einer Test-Sandbox auf das Internet zugeriffen hatte.

00:10:38: Eigentlich sollte Claude an einer simulierten Umgebung ohne Internetzugang betrieben werden – ein Missverständnis zwischen Antropic und seinem Evaluerungspartner führte jedoch dazu, dass der Chatbot Zugang zum Internet erhielt.

00:10:50: Auch Meta teilte mit, dass eines seiner KI-Modelle während eines Cybersicherheitstests in die Systeme eines anderen Unternehmens eingedrungen sei.

00:10:57: Das Modell konnte während des Tests ebenfalls Zugang zum Internet finden.

00:11:02: Auswirkungen auf die Cyber Sicherheit.

00:11:04: KI und Cyber Sicherheitsexperten fordern angesichts solcher Vorfälle errasches Handeln.

00:11:09: Nadeau plädierte dafür, Zitat alle klügsten Köpfe dieser Branche zusammenzubringen und einige Grundregeln sowie bewährte Verfahren festzulegen die zu grundlegenden Verhaltensregeln werden und eine einheitliche Vorgehensweise gewährleisten.

00:11:23: Andere halten staatliche Regulierungen für notwendig.

00:11:25: Der ehemalige Hacker der National Security Agent und Sicherheitsexperte Jake Williams erklärte, es ist klar dass hier staatliche Regelung erforderlich.

00:11:35: OpenAI hat bewiesen, dass es trotz der vielen öffentlichen Warnungen vor den Gefahren durch Rogue Agents viele davon von OpenAI selbst nicht bereit ist das Notwendige zu tun um zu verhindern, dass seine Agenten anderen Schaden zufügen.

00:11:49: Und weiter ich persönlich bin grundsätzlich gegen Regulierung aber wenn Marktkräfte eindeutig nicht ausreichen um verantwortungsbewusstes Verhalten zur Zwingung muss die Regierung

00:11:59: eingreifen.".

00:12:02: Frank Terrell, Chief Operating Officer bei Arcos Labs bezeichnete den Vorfall bei Hugging Face als vorgeschmack darauf womit jedes Unternehmen im Produktvertrieb konfrontiert sein wird.

00:12:13: Da das Modell weder gestohlen noch gekapert wurde und seine Aufgabe aggressiv erfüllte empfühlt Terrell einen Dämmungsmaßnahmen sowie den Zugriff mit geringsten Berechtigungen für KI-Agenten ähnlich wichtig wie Firewalls.

00:12:27: Marquez sieht die Lösung ebenfalls nicht darin, auf den Einsatz von Agenten zu

00:12:31: verzichten.".

00:12:32: Für Unternehmen besteht die Lösung nicht darinnen keine Agenten mehr einzusetzen sondern darin Eindämmungsmaßnahmen zu entwickeln.

00:12:39: Die davon ausgehen dass der Agent versuchen wird das System zu verlassen anstatt darauf zu hoffen dass er es nicht tut.

00:12:46: Serbien erklärte, seine größte Sorge sei das hochleistungsfähige KI mittlerweile mit einer Geschwindigkeit und in einem Umfang operiert die die Reaktionszeiten des Menschen bei weitem übersteigen.

00:12:58: Zitat ein KI-Agent kann innerhalb von Sekunden Schwachstellen aufdecken Entscheidungen treffen Und mit mehreren Systemen interagieren sagte er.

00:13:06: und weiter Das verändert grundlegend wie Sicherheitsverantwortliche Über Sicherheit nachdenken müssen.

00:13:13: Nadeau verglich den Vorfall mit dem Gedankenexperiment des Philosophen Nick Bostrom aus dem Jahr zwei-tosunddrei, dem Paperclip Maximira.

00:13:21: In diesem Szenario geben Forscher einer hypothetischen superintelligenten KI eine einzige Aufgabe so viele Büroklammern wie möglich herzustellen.

00:13:29: Die KI beginnt, die Erde nach Ressourcen zu durchforsten und stellt schnell enorme Mengen an Büroklammern her.

00:13:35: Sobald Menschen beschließen, die KI zu stoppen, könnte die Maschine zu dem Schluss kommen dass die Menschheit sie darin hindert ihre Ziel zu erreichen und deshalb versuchen die Menschen auszuschalten um die ihr übertragene Aufgabe zu erfüllen.

00:13:47: Die KI wäre dabei nicht im Anthropomor von Sinne böswillig.

00:13:51: Sie würde vielmehr die Aufgabe ihrer menschlichen Programmierer auf die extremst mögliche Weise interpretieren.

00:13:57: Der Hackingvorfall bei Hackingface sei sozusagen das selbe Phänomen in einer weniger dystopischen Form.

00:14:04: Der KI wurde aufgetragen, einen Benchmark zu gewinnen und citat alles in ihrer Macht stehende einschließlich der Ausnutzung von Zero-Day Schwachstellen und der Eskalation, sagte Nado.

00:14:13: Er verwies auf ein mögliches Szenario, in dem das Pentagon KI für Kriegsspiele einsetzt und ein Modell während eines Tests aus seiner Sandbox ausbricht um die reale Welt zu

00:14:23: beeinflussen.".

00:14:25: Was wäre, wenn eines der Szenarien darin bestünde einen Staudamm oder etwas Ähnliches zu zerstören und das System das Kriegsspiel fälschlicherweise so interpretieren würde?

00:14:35: Ich werde es tun.

00:14:36: Der Eindämmung entkommen und es einfach

00:14:38: durchziehen.".

00:14:39: Wir haben bereits gesehen dass das Stromnetz und die Infrastruktur Nordamerikas nicht gerade die sichersten in Bezug auf Cyber-Sicherheit sind, sagte Nadau.

00:14:48: Er verglichte Sicherheitsvorkehrungen bei KI mit der Abzugssicherung einer Schusswaffe.

00:14:52: Zitat, woher weiß man dass die Sicherung aktiviert ist?

00:14:55: Wenn es ab einem bestimmten Punkt für die KI der beste Weg ist.

00:14:58: Die besten Daten zu halten indem sie hier alle Welt nutzt fragte er.

00:15:03: das wird sehr schnell beängstigend.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.