Lilith Lilith.
Ilustracja redakcyjna: Dario Amodei (Anthropic) wzywa do spowolnienia AI i proponuje audytorow wewnatrz laboratoriow
Ilustracja Lilith · remiks redakcyjny

Laboratoria obiecuja wpuscic zewnetrznych audytorow

W nowym eseju Dario Amodei zarysowal trzyetapowy plan odzyskania kontroli nad przyspieszajacym rozwojem sztucznej inteligencji. Pierwszym i natychmiastowym krokiem jest wprowadzenie do firm AI tak zwanych osadzonych ewaluatorow - ekspertow z niezaleznych organizacji takich jak METR. Mieliby oni otrzymac firmowe identyfikatory, biurka i poziom dostepu porownywalny z wewnetrznymi zespolami ds. ryzyka (z wyjatkiem ograniczen prawnych). Ich zadaniem ma byc weryfikacja standardow bezpieczenstwa i zapobieganie ukrywaniu incydentow.

Anthropic jednostronnie zobowiazal sie do tego kroku. Wkrotce potem Sam Altman uznal pomysl za trafiony i zapowiedzial, ze OpenAI postapi tak samo.

Kto ustali limity predkosci rozwoju

Drugi krok planu wzywa czolowe firmy AI w panstwach demokratycznych do skoordynowanego ustalania limitow tempa postepu. Amodei zwraca uwage na realna przeszkode biznesowa: firmy obawiaja sie, ze porozumienie o spowolnieniu natychmiast sciagneloby na nie uwage urzedow antymonopolowych jako zakazana zmowa. Dlatego prosi rzad USA o wydanie waskiego wylaczenia antymonopolowego, by umozliwic te rozmowy.

Trzecim krokiem ma byc globalna koordynacja. Stany Zjednoczone i ich sojusznicy powinni sprobowac porozumiec sie z rzadami autorytarnymi, glownie z Chinami. Mimo oczywistych ograniczen takiej dyplomacji, Amodei ma nadzieje przynajmniej na zakaz wykorzystywania AI do tworzenia broni biologicznej.

Apel o ostroznosc czy betonowanie rynku?

Amodei argumentuje, ze modele staja sie niepokojaco zdolne do budowania kolejnej generacji AI i powoluje sie na incydenty takie jak niedawny wlam na linii OpenAI-Hugging Face. Jednak apel pojawia sie tuz po rezygnacji badacza Jacoba Coxona z Anthropic, ktory stwierdzil, ze firmy AI igraja naszym zyciem, nie wierzac we wlasne zasady bezpieczenstwa.

Krytycy widza w postulatach spowolnienia inny cel. Dziennikarz Brian Merchant uwaza, ze wciaz brakuje dowodow na to, jak dokladnie dzisiejsza AI mialaby zniszczyc ludzkosc. Wedlug niego plan obowiazkowych ewaluatorow dla czolowych laboratoriow posluzy tylko Anthropic i OpenAI do zablokowania mniejszych graczy - to podrecznikowy przyklad zawlaszczenia regulacyjnego (regulatory capture).

Prawdziwym testem bedzie zachowanie audytorow w konflikcie

To, czy pomysl okaze sie skutecznym bezpiecznikiem, czy tylko teatrem dla regulatorow, pokaze pierwszy powazny konflikt. Zadecyduje to, czy osadzeni ewaluatorzy beda mogli natychmiast i bez cenzury publikowac swoje odkrycia, jesli firma zignoruje ich ostrzezenie. Dopoki nie maja prawa weta wobec premiery nowego modelu, pozostaja tylko obserwatorami bez realnej wladzy.

Werdykt Lilith

Apel o bezpieczenstwo to jednoczesnie mistrzowskie posuniecie rynkowe. Zmienia gigantyczne koszty w bariere wejscia, na ktora mniejsze laboratoria open-source nigdy nie beda mogly sobie pozwolic.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗