Lilith Lilith.
Ilustracja redakcyjna: CEO Anthropic Dario Amodei proponuje trzyetapowy plan hamowania AI
Ilustracja Lilith · remiks redakcyjny

Szef jednego z największych laboratoriów mówi, że czas zwolnić

CEO Anthropic Dario Amodei opublikował obszerny esej, w którym proponuje trzyetapowy plan „regulowania tempa na granicy” (pace the frontier) i spowolnienia rozwoju AI. Anthropic zobowiązał się również umożliwić niezależnym ewaluatorom, takim jak METR (Model Evaluation and Threat Research), bezpośredni dostęp do swoich modeli w celu weryfikacji ich bezpieczeństwa.

Amodei argumentuje, że postęp technologiczny jest obecnie zbyt szybki, aby społeczeństwo i organy regulacyjne zdążyły się zaadaptować. Zamiast całkowitego zakazu badań proponuje jednak ustrukturyzowany system mechanizmów kontroli i równowagi, który zapobiegałby wypuszczeniu potencjalnie niebezpiecznych systemów.

Wniosek przenosi odpowiedzialność na niezależne audyty

Trzyetapowy plan Amodei obejmuje wewnętrzne zobowiązania laboratoriów, regulacje na szczeblu krajowym oraz umowy międzynarodowe. Sednem jest to, że o wdrożeniu modelu nie powinien decydować wyłącznie jego twórca na podstawie wewnętrznych metryk. Twierdzi on, że zewnętrzni audytorzy, tacy jak METR, potrzebują dostępu „red teaming” jeszcze w trakcie treningu, a nie tylko tuż przed premierą.

Dla całej sceny rozwoju modeli bazowych to sygnał: jeśli lider jednego z najlepszych modeli na świecie (Claude 3.5 Sonnet) sam wzywa do wciśnięcia hamulca, presja regulacyjna wzrośnie. Inne laboratoria będą musiały pokazać, jak ich własne protokoły bezpieczeństwa wypadają na tle propozycji Anthropic.

Zasady muszą obowiązywać wszystkich, inaczej nie mają sensu

Pomysł audytów ma sens na papierze, ale zderza się z realiami rynku. Sam Amodei przyznaje w eseju, że gdyby Anthropic zwolnił w pojedynkę, straciłby tylko udział w rynku na rzecz OpenAI, Google lub społeczności open-source. Bez globalnego konsensusu lub twardych regulacji rządowych (takich jak amerykański zakaz eksportu zaawansowanych chipów do Chin) dobrowolne hamowanie to komercyjne samobójstwo.

Jednocześnie pojawiają się podejrzenia o „zawłaszczenie regulacyjne” (regulatory capture). Jeśli rządy przyjmą surowe zasady certyfikacji, które będą w stanie spełnić tylko Anthropic, OpenAI i Google, startupy z mniejszym kapitałem i projekty open-source zostaną skutecznie odcięte od rozwoju na najwyższym poziomie.

Decydująca będzie reakcja konkurencji i agencji rządowych

Zobaczymy, czy inne duże laboratoria poprą ten plan, czy też uznają go za próbę zabetonowania przez Anthropic obecnego status quo, w którym ma już silną pozycję.

Prawdziwym dowodem na to, że coś się zmienia, nie będą kolejne wpisy na blogach o bezpieczeństwie, ale to, czy organy rządowe w USA (takie jak AI Safety Institute) przekują propozycje Amodei w wiążące przepisy dotyczące dostępu do mocy obliczeniowej i certyfikacji modeli.

Werdykt Lilith

Wołanie o regulacje, gdy masz jeden z najlepszych modeli na rynku, to sprytne posunięcie biznesowe. To próba zbudowania ogrodzenia tak wysokiego, by mogli przez nie przejść tylko ci, którzy już za nim stoją.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗