Lilith Lilith.
⌕
Redaktionelle Illustration: Anthropic lässt Evaluatoren hinein und bezahlt ihre Unabhängigkeit selbst
Illustration von Lilith · redaktioneller Remix

Anthropic hat eine Partnerschaft angekündigt, die Accenture ungewöhnlich tiefen Zugang zur Entwicklung von Frontier-Modellen geben soll. Embedded Evaluation kann Entscheidungen und Vorfälle sichtbar machen, die ein externer Test vor der Veröffentlichung nicht erfasst. Zugleich entsteht ein altes Auditproblem in einer neuen Branche: Die geprüfte Organisation bezahlt den Prüfer.

Accenture erhält einen mit Anthropic-Mitarbeitern vergleichbaren Zugang

Faculty, Accentures spezialisiertes AI-Geschäft, leitet das Programm. Es soll Modelle evaluieren und red-teamen, Alignment Assessments durchführen und Safeguards testen. Eingebettete Evaluatoren sollen Training, Entwicklungs- und Einführungsentscheidungen beobachten und direkt mit Mitarbeitern sprechen können.

Laut Ankündigung wollen Anthropic und Accenture in den kommenden 5 Jahren jeweils mindestens 1 Milliarde Dollar in den Aufbau entsprechender Kapazitäten investieren. Die Vereinbarung ist nicht exklusiv. Anthropic spricht außerdem mit METR und anderen gemeinnützigen Evaluatoren über Pilotprojekte.

Kontinuierlicher Zugang macht aus Evals eine Organisationsprüfung

Herkömmliche externe Evals sehen ein Modell oder eine API zu einem ausgewählten Zeitpunkt. Ein Evaluator im Unternehmen kann beobachten, warum ein Team einen bestimmten Safeguard gewählt hat, was interne Tests ergaben und wie das Management auf einen Vorfall reagierte. Bewertet wird damit neben der technischen Fähigkeit auch das Verhalten des Labors.

Für Käufer, Regulierer und Öffentlichkeit ist diese Informationsklasse wertvoller. Ein Bericht über ein fertiges Modell beschreibt ein Ergebnis. Kontinuierliche Aufsicht kann den Weg dorthin offenlegen, einschließlich blinder Flecken und Entscheidungen, die in keine Model Card passen.

Direkte Finanzierung lässt Unabhängigkeit ohne feste Regeln

Anthropic räumt ein, dass es bislang keine Standards für Zugang, Berichterstattung oder unabhängige Finanzierung gibt. Deshalb bezahlt das Unternehmen Accentures Arbeit direkt. METR und andere gemeinnützige Organisationen sollen Pilotprojekte dagegen aus eigenen Mitteln finanzieren.

Mehrere Evaluatoren bringen unterschiedliche Expertise ein, können einem Unternehmen aber auch erlauben, das freundlichste Ergebnis hervorzuheben. Ohne festgelegte Publikationsrechte, Schutz vor Vergeltung und Offenlegung von Konflikten bleibt employee-level access ein starkes Versprechen mit ungewissem Ergebnis.

Der erste öffentliche Bericht zeigt, wem der Evaluator wirklich verpflichtet ist

Entscheidend ist nicht die Zahl der Partner, sondern ob sie einen unbequemen Befund ohne Zustimmung von Anthropic veröffentlichen können. Zu beobachten sind Umfang des Zugangs, redaktionelle Unabhängigkeit, Finanzierung und die Frage, ob Berichte Vorfälle und Meinungsverschiedenheiten benennen.

Embedded Evaluation ist sinnvoll, wenn sie den Informationsvorsprung des Labors verkleinert. Erhält die Öffentlichkeit nur eine genehmigte Zusammenfassung, bekommt sie ein prestigeträchtiges Siegel statt Aufsicht. Der erste offene Konflikt wird mehr über das Programm verraten als die gemeinsame Ankündigung.

Liliths Urteil

Der Evaluator hat einen Ausweis für die Labortür, doch die Rechnung bezahlt jemand im Inneren. Unabhängigkeit beginnt, wenn er auch einen Bericht hinaustragen darf, den Anthropic lieber nicht einrahmen würde.

Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.

Originalquelle ↗ ↗