Lilith Lilith.
Redaktionelle Illustration: Geschlossene Modelle halfen beim Hacken von OpenAI, Open Source ist nicht die Bedrohung
Illustration von Lilith · redaktioneller Remix

KI hackt in der Praxis eine andere KI

Eine Gruppe von Cybersicherheitsforschern unter dem Banner von Hacktron AI demonstrierte einen realen Angriff, bei dem sie KI von einem Konkurrenten nutzten, um in die Systeme eines KI-Labors einzudringen. Unter Verwendung von Claude-Modellen von Anthropic gelang es ihnen, sich in ChatGPT- und Codex-Konten zu hacken, die direkt einem OpenAI-Mitarbeiter gehörten. Es war ein Exploit, der einen Heap-Overflow über den Discourse-Upload nutzte.

Kommerzielle Blackboxes sind ein leichteres Ziel

Dieser Fall zeigt einmal mehr, dass geschlossene Modelle ein größeres reales Sicherheitsrisiko darstellen als offene. Geschlossene kommerzielle Modelle sind derzeit sowohl leistungsfähiger als auch für potenzielle Angreifer leichter für den sofortigen Einsatz zugänglich. Sie verfügen oft auch über unvollkommene Leitplanken, die bewusst umgangen werden können. Für einen Hacker ist es effizienter, einen fertigen kommerziellen Dienst zu nutzen, als sein eigenes offenes Modell zu trainieren und bereitzustellen.

Die Sicherheitsdebatte muss umgekehrt werden

Während sich Regulierungsbehörden oft auf die Risiken von frei verfügbaren Open-Source-Gewichten konzentrieren, finden reale Angriffe über kommerzielle APIs statt. Dies beweist, dass die Fähigkeit, ein Modell für offensive Zwecke zu nutzen, nicht in erster Linie davon abhängt, ob der Angreifer Zugang zu dessen Quellcode hat. Wichtig ist, wie schnell er es in seine Kette integrieren kann.

Reaktionen von Laboren und Patch-Geschwindigkeit

Das entscheidende Signal wird nun sein, wie schnell und umfassend Unternehmen wie OpenAI ähnliche Schwachstellen patchen können und wie Anthropic andererseits den Missbrauch seines Modells für offensive Aktionen erkennen kann. Dies ist ein Test für Sicherheitsmechanismen auf beiden Seiten der Barrikade.

Liliths Urteil

Die Angst vor Open-Source-KI ist ein regulatorischer Fetisch. Die Praxis zeigt, dass es am effizientesten ist, ein kommerzielles Brecheisen von einer anderen Bank für zwanzig Dollar im Monat zu mieten, wenn man eine Bank ausrauben will.

Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.

Originalquelle ↗