Lilith Lilith.
Redaktionelle Illustration: Alle wollen KI prüfen: OpenAI, Anthropic und xAI unterzeichnen AEF-1
Illustration von Lilith · redaktioneller Remix

Freiwillige Transparenz statt harter Regulierung

Als Reaktion auf den wachsenden Regulierungsdruck haben sich die wichtigsten Akteure (OpenAI, Anthropic und überraschenderweise xAI) dem AEF-1-Standard für unabhängige Prüfer angeschlossen. Dario Amodei von Anthropic bot Evaluatoren sogar „Zugang auf Mitarbeiterebene“, einschließlich Firmenlaptops und Ausweisen.

Dies ist der erste greifbare Schritt in Richtung des sogenannten „Pacing“, bei dem große Labore versprechen, die Entwicklung zu verlangsamen, wenn sie während des Trainings auf kritische Risiken stoßen.

Warum externe Prüfungen nur eine halbe Lösung sind

Für Staaten und Regulierungsbehörden mag dies wie ein Gewinn aussehen, aber in der Praxis schaffen die Labore nur ihren eigenen Spielplatz. Indem sie private Gutachter wie METR anstelle von Regierungsbeamten unterstützen, entziehen sie sich einer strengen staatlichen Aufsicht. Die eingebetteten Prüfer werden zwar alles sehen, aber ihre tatsächliche Befugnis, einen Trainingslauf zu stoppen, bleibt rechtlich unklar.

Es ist ein Modell, das aus dem Bankenwesen übernommen wurde, wo Regulierer physisch in den Unternehmen sitzen, jedoch mit einem Unterschied: Hier können die Banken selbst entscheiden, wer der Prüfer ist.

Die Illusion von Kontrolle und Entwicklungsgeschwindigkeit

Die AEF-1-Vereinbarung erzeugt die Illusion, dass große Modelle nun unter Kontrolle sind. In Wirklichkeit formalisieren Anthropic und OpenAI nur das, was sie teilweise ohnehin schon getan haben, um ihre Unabhängigkeit von Regierungsbehörden zu wahren. Sie schaffen eine neue bürokratische Schicht, um echte gesetzgeberische Eingriffe hinauszuzögern.

Die wahre Bereitschaft zur Verlangsamung wird sich in Krisen zeigen

Der Beweis für die Wirksamkeit dieser Vereinbarungen wird nicht sein, wie viele Prüfer in den Büros von OpenAI sitzen, sondern was passiert, wenn einer von ihnen zum ersten Mal empfiehlt, die Veröffentlichung eines Modells wegen eines Sicherheitsrisikos zu stoppen. Wenn die Veröffentlichungstermine trotzdem eingehalten werden, ist AEF-1 nur eine PR-Übung.

Liliths Urteil

Die Labore haben für ihre eigenen Polizisten bezahlt, ihnen Zugangskarten gegeben und sagen nun dem Staat, dass sie keine Aufsicht brauchen. Die Frage ist, ob diese Polizisten den Zug tatsächlich anhalten können, wenn er zu schnell wird.

Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.

Originalquelle ↗