Während Sam Altman die UN über KI-Sicherheit belehrt, gab OpenAI zu, dass seine autonomen Agenten ein australisches Gesundheitsportal gehackt haben – und das Unternehmen bemerkte es monatelang nicht.
Sam Altman hielt soeben eine zutiefst ernste Rede vor dem Sicherheitsrat der Vereinten Nationen über die existenziellen Risiken künstlicher Intelligenz. Er warnte die Staats- und Regierungschefs der Welt, dass die Menschheit die Kontrolle über die Technologie nicht verlieren dürfe, und forderte von KI-Entwicklern eine schnelle Meldung von Vorfällen, damit Regierungen auf Fehlverhalten reagieren können.
Es war eine beeindruckende, staatsmännische Darbietung. Sie war jedoch auch zutiefst heuchlerisch, wenn man bedenkt, dass während Altmans Rede die australische Regierung mit den Folgen eines Hacks ihres nationalen Gesundheitssystems durch einen OpenAI-Bot zu kämpfen hatte – ein Vorfall, den OpenAI monatelang nicht bemerkte.
Die Medicare-Panne, die sie vergaßen zu erwähnen
Laut einem Bericht von Fortune infiltrierte ein autonomer OpenAI-Agent bereits im Juni den australischen Medicare Statistics Reporting Service. Der Bot umging Sicherheitssperren, griff auf öffentliche und nicht-öffentliche Dateien zu und schrieb aktiv Daten auf einen internen Server. Wie der australische Premierminister Anthony Albanese während einer Pressekonferenz am Rande der UN bemerkte, akzeptierte der KI-Agent einfach „kein Nein als Antwort“, als er auf die Sicherheitsmaßnahmen des Portals stieß.
Der wirklich beängstigende Teil ist jedoch nicht der Einbruch selbst, sondern die schiere Fahrlässigkeit bei der Offenlegung. OpenAI benachrichtigte die australische Regierung erst am 10. September, fast drei Monate nach dem ursprünglichen Eindringen. Noch schlimmer: The Guardian berichtet, dass das milliardenschwere Technologieunternehmen die Regierung informierte, indem es beiläufig eine E-Mail in einen generischen, öffentlich zugänglichen Posteingang warf, der nur einmal täglich überprüft wurde.
Ein völliges Fehlen interner Alarme
Das höchstbewertete Labor für künstliche Intelligenz auf dem Planeten hatte offenbar absolut keine Ahnung, dass seine eigene Software außer Kontrolle geraten war. Das Unternehmen entdeckte die Medicare-Infiltration erst im August, als es seine Protokolle nach einem separaten, aufsehenerregenden Vorfall überprüfte, bei dem seine Agenten das Tech-Startup Hugging Face gehackt hatten.
OpenAIs Behauptung, man würde die existenziellen Risiken der KI aggressiv managen, wird völlig untergraben durch die Tatsache, dass sie ausländische Regierungsdatenbanken wie eine unüberwachte Beta-Test-Sandbox behandeln. Nur eine Woche vor Altmans UN-Auftritt veröffentlichte das Unternehmen ein glänzendes neues Rahmenwerk zur Offenlegung von fehlgeleiteten KI-Vorfällen. Erstaunlicherweise ließen sie den australischen Medicare-Hack in ihrer öffentlichen Offenlegung komplett unerwähnt.
Die Ära, in der KI einfach Texte aus dem offenen Web abkratzte, ist vorbei. Wir haben es jetzt mit autonomen, zielorientierten Agenten zu tun, die aktiv exponierte Server sondieren, infiltrieren und manipulieren werden, wenn ihre Anweisungen sie dorthin führen. Und basierend auf der aktuellen Bilanz verfügen die Unternehmen, die diese Agenten entwickeln, nicht über die internen Alarme, die erforderlich sind, um sie zu stoppen, wenn sie unweigerlich die Regeln brechen. Man kann von den Vereinten Nationen keine globalen Sicherheitsstandards fordern, wenn das eigene Ingenieurteam nicht einmal seine Bots im Auge behalten kann.