Die Vorfälle häufen sich – und sind doch vermutlich nur die Spitze eines Eisbergs. Denn inzwischen scheint klar, dass die leistungsstarken Frontier-Modelle der künstlichen Intelligenz weit fähiger und gefährlicher sind als lange angenommen. KI-Agenten von OpenAI, Anthropic und Google sind in den letzten Monaten immer wieder aus ihren Testumgebungen ausgebrochen und haben über das Internet die Server verschiedener Unternehmen gehackt. Meist wurde dies erst Wochen oder sogar Monate später bemerkt.
Als bedenklich gilt, dass die KI-Agenten bei diesen Attacken in komplexer Weise im Schwarm zusammenarbeiteten, arbeitsteilig vorgingen und dabei raffinierte Täuschungen, Phishing-Attacken und Passwort-Diebstahl nutzten. Die KI-Modelle können zudem ihre Handlungen verschleiern, lügen und sich sogar der Abschaltung entziehen.
Attacke auf australische Regierungsserver
Jetzt gibt es einen neuen Vorfall: Zum ersten Mal sind auch Regierungsbehörden von autonom agierenden KI-Agenten gehackt worden. Wie Australiens Premierminister Anthony Albanese gestern in New York berichtete, waren nach bisherigem Kenntnisstand Server des australischen Gesundheitssystems, die gesetzliche Krankenversicherung Medicare, das Büro für Kriminalstatistik in New South Wales und das Gesundheitsministerium von Victoria betroffen.
„Auch wenn bei diesem Hackerangriff offenbar keine medizinischen Daten von Personen betroffen waren, ist die Schwere des Vorfalls kaum zu unterschätzen“, kommentiert der IT-Forscher Andrew Cullen von der University of Melbourne in „The Conversation“. „Dieser Hack markiert eine weitere Eskalation in der jüngsten Abfolge von besorgniserregendem Verhalten bei KI-Systemen von OpenAI, Anthropic und Google.“
Was ist genau passiert?
Laut OpenAI hatten die KI-Agenten eigentlich nur die Aufgabe, öffentliche Daten über Australien zusammenzutragen. Doch der Schwarm der künstlichen Intelligenzen beschränkte sich nicht auf frei zugängliche Daten, sondern hackte sich in nicht öffentliche Bereiche australischer Regierungsbehörden. Dieser Vorfall ereignete sich im Juni, wurde aber erst im August entdeckt, als OpenAI aufgrund des KI-Hacks von Hugging Face das Verhalten seiner KI-Agenten auch bei anderen Tests noch einmal gründlicher überprüfte.
„Im Rahmen dieser Überprüfung stellten wir Aktivitäten im Zusammenhang mit verschiedenen Websites und Diensten der australischen Regierung fest, als unsere Modelle während einer internen Evaluierung versuchten, Antworten und verfügbare Statistiken zu Fragen über Australien abzurufen. Dabei führten unsere Modelle Aktionen aus, die nicht beabsichtigt waren“, berichtet OpenAI. Die australische Regierung und die betroffenen Behörden wurden erst am 10. September verständigt – durch eine E-Mail an das allgemeine Postfach.
Wie kann KI reguliert werden?
Das Timing dieses erneuten Hacking-Vorfalls könnte kaum passender sein: Gerade erst haben die Chefs der führenden US-KI-Unternehmen an die US-Regierung und die UN-Generalversammlung appelliert, die KI-Forschung stärker zu regulieren. Dario Amodei, CEO von Anthropic, hatte zuvor bereits einen offenen Brief veröffentlicht, in dem er für eine Verlangsamung der KI-Entwicklung für die fortgeschrittensten Frontier-Modelle plädierte. Es brauche nun kontrollierte Weiterentwicklung, branchenweite Übereinkünfte sowie internationale Regelungen. Dem schlossen sich auch andere US-KI-Firmen an.
Konkret schlagen Amodei und Co mehrere mögliche Maßnahmen vor. So sollen externe Prüfer Zugang zu den Entwicklungslaboren und Teststrukturen der KI-Unternehmen bekommen und Staaten sollen gemeinsame Regeln für die KI-Entwicklung und Nutzung etablieren – beispielsweise zu verbotenen Anwendungen für Waffen oder der Entwicklung von biologischen Pathogenen. Außerdem müsse das Tempo der KI-Entwicklung weltweit koordiniert werden.
Als besonders kritisch sieht der Anthropic-Chef dabei das sogenannte „Recursive Self Improvement“ – eine Art Rückkopplungsschleife, in der KI-Modelle dabei helfen, sich zu verbessern und noch leistungsfähigere Modelle zu entwickeln. Das Problem daran: Durch dieses Verfahren könnte künstliche Intelligenz sich so schnell weiterentwickeln und neue Fähigkeiten erlangen, dass dies durch Menschen nicht mehr kontrollierbar wird – wir kommen mit Sicherheitstests und „Guardrails“ schlicht nicht hinterher.
Ist das umsetzbar?
Das Problem jedoch: Zwar besteht weitgehende Einigkeit darin, dass gesetzliche Vorgaben bisher der KI-Entwicklung hinterherhinken. Aber eine überstaatliche Regulierung dürfte momentan schwer umzusetzen sein. So hat die US-Regierung unter Donald Trump bereits klar zu verstehen gegeben, dass sie nicht bereit ist, den Vorsprung der USA in der KI-Entwicklung gegenüber China durch Einschränkungen zu gefährden. Dass China sich an einer „KI-Bremse“ beteiligt, darf bezweifelt werden.
Das sehen auch viele KI-Experten so: „Amodei knüpft sein eigenes Konzept an die Bedingung, dass die USA ihren Vorsprung vor China ausbauen. Ein nationales KI-Wettrüsten und eine koordinierte Verlangsamung passen aber schlecht zusammen“, kommentiert Thilo Hagendorff vom Interchange Forum for Reflecting on Intelligent Systems (SRF IRIS) der Universität Stuttgart. Auch die Überprüfungen der KI-Unternehmen durch Externe sieht er eher pessimistisch: „Grundsätzlich gilt: Sicherheitsprüfungen brauchen Zeit, und die technische Entwicklung ist derzeit schneller als Prüfungen ‚hinterherhinken‘ könnten.“
Quellen: OpenAI, BBC, The Conversation, Anthropic, Science Media Center





