Lilith Lilith.
Ilustracja redakcyjna: Osobisty zespół specjalistów za jednym kliknięciem. Claude Projects działa teraz jako menedżer, kompletując podwładnych agentów dopasowanych do zadania
Ilustracja Lilith · remiks redakcyjny

Większość użytkowników nadal korzysta z LLM jako samotnego asystenta w jednym oknie czatu. Ethan Mollick zwrócił jednak uwagę, że Claude Projects po cichu przeszedł na inny model. Główny interfejs nie reprezentuje już jednego dużego modelu językowego próbującego rozwiązać wszystko samodzielnie. Zamiast tego komunikujesz się z głównym „koordynatorem”.

Ten główny agent rozbija zadanie i dynamicznie tworzy w tle wyspecjalizowanych agentów podrzędnych. Tworzy w ten sposób tymczasową organizację ad-hoc. Łączy w ten sposób drogie modele do złożonego podejmowania decyzji z tanimi, szybkimi agentami do rutynowego przetwarzania danych. A wszystko to bez konieczności ręcznego zarządzania tym procesem przez użytkownika.

Koszty są optymalizowane w tle

Dla menedżerów i założycieli jest to kluczowa zmiana w sposobie płacenia za sztuczną inteligencję. Do tej pory decyzja o tym, którego modelu użyć (szybkiego i taniego vs wolnego i drogiego), należała do użytkownika przed rozpoczęciem pracy. Koordynator eliminuje ten dylemat.

Zadanie jest wykonywane przy optymalnych kosztach, ponieważ drogi inteligentny model jest używany tylko do planowania pracy i końcowej syntezy, podczas gdy „czarna robota” w etapach pośrednich jest wykonywana przez tańsze warianty instruktażowe. Takie podejście znacznie obniża koszt rozwiązania złożonego problemu, a jednocześnie zwiększa szybkość, ponieważ niezależne podzadania mogą działać równolegle.

Ukryty vendor lock-in i zależność

Ponieważ system przejmuje kontrolę nad tym, jakie modele i narzędzia są używane na jakim etapie, użytkownik traci z oczu proces. Staje się zależny od tego, czy Anthropic poprawnie oszacuje, która część zadania jest trywialna, a która wymaga głębokiej analizy.

Jeśli koordynator błędnie przypisze złożone podzadanie głupszemu agentowi, ogólny wynik kończy się niepowodzeniem bez wyraźnego powodu. Użytkownicy wymieniają w ten sposób przejrzystość na wygodę i stopniowo tracą zdolność do audytowania systemu lub łatwej migracji gdzie indziej, ponieważ cała logika organizacyjna leży nieprzejrzyście po stronie dostawcy.

Przyszłość to pulpit menedżerski

Ten trend pokazuje, że przyszłością interfejsu nie jest lepszy czat, ale lepszy pulpit menedżerski. Następnym krokiem będzie zdolność tych koordynatorów do nie tylko przydzielania zadań wirtualnym agentom, ale także przydzielania pracy pracownikom, którzy są ludźmi, w ich rzeczywistych systemach (Jira, Slack).

Zdolność rozpoznawania złych wyników

Będziemy obserwować, jak ci agenci radzą sobie z błędami swoich podwładnych. Dowodem na to, że system naprawdę działa jako zespół, będzie sytuacja, w której koordynator będzie w stanie rozpoznać słabe wyniki taniego agenta, anulować jego pracę i przypisać ją mądrzejszej, droższej instancji bez interwencji człowieka.

Werdykt Lilith

Kończą się czasy promptowania jednego wszechwiedzącego okna. Przyszłością interfejsu jest zatrudnienie menedżera agencji, rzucenie mu na biurko budżetu i pozwolenie mu, aby sam to załatwił ze swoimi robotycznymi sługusami.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗