2026-07-21 · ← Radar
Sakana Fugu sprzedaje multi-agent orchestration jako jeden model w API
Sakana AI pakuje multi-agent orchestration w produkt, który z zewnątrz wygląda jak jeden model dostępny przez API zgodne z OpenAI. Zamiast ręcznie zaprojektowanego workflow Fugu ma wybierać i koordynować pulę wyspecjalizowanych modeli pod konkretną pracę.
Fugu chowa zespół agentów za jednym endpointem
Strona produktu opisuje trzy warianty: Fugu, Fugu Ultra i Fugu Cyber. Podstawowe Fugu celuje w codzienną pracę z niższą latencją, Ultra w trudniejsze problemy, a Cyber w analizę bezpieczeństwa, vulnerability research i threat investigation.
Sakana opiera system na dwóch pracach przyjętych na ICLR 2026: TRINITY i Conductor. Pierwsza używa lekkiego koordynatora, który przydziela modelom role Thinker, Worker i Verifier. Druga uczy koordynacji w języku naturalnym przez reinforcement learning.
Firma twierdzi, że Fugu Cyber osiąga 86,9 % skuteczności na CyberGym i 72,1 % na CTI-REALM. Porównuje go z modelami frontier wyspecjalizowanymi w cyberbezpieczeństwie, takimi jak GPT-5.5-Cyber i Mythos-Preview. Ważne zastrzeżenie: to claim vendora, nie niezależny audyt.
Kupujący płaci za zarządzanie modelami, nie za kolejnego chatbota
Najciekawsze w Fugu nie jest to, że dochodzi następny model do listy. Produkt sprzedaje sterowanie mieszanką modeli jako osobną warstwę. Dla zespołów, które już dziś łączą Codex, Claude, Gemini albo własne modele w wewnętrznych workflow, to próba zamienienia orchestration w gotową usługę.
Praktyczna wartość jest jasna: mniej kleju integracyjnego, jeden endpoint i możliwość wykluczenia konkretnych providerów albo modeli z puli ze względu na dane, prywatność lub compliance. Jeśli to działa, kupujący nie bierze tylko wyniku z benchmarku. Bierze też decyzję o tym, który model dostanie którą część zadania.
Mocne benchmarki nie zastępują dowodu z produkcji
Słabym punktem jest weryfikowalność. Sakana pokazuje mocne liczby i przykłady, ale część wyników bazowych pochodzi od dostawców modeli, a część modeli w przykładach jakościowych jest zanonimizowana. To dobre do pierwszej orientacji, nie do decyzji zakupowej.
Drugim hamulcem jest dostępność. Strona wprost mówi, że Fugu nie jest jeszcze dostępne w UE ani EOG, dopóki Sakana pracuje nad zgodnością z GDPR i europejskimi regulacjami. Dla polskiego albo czeskiego zespołu to nie jest przypis, tylko bramka zakupowa.
O produkcie zdecydują audyty orchestratora i wejście do Europy
Teraz warto patrzeć, czy pojawią się powtarzalne niezależne testy na CyberGym, CTI-REALM i zwykłych zadaniach engineeringowych. Przy orchestration nie wystarczy wiedzieć, że wynik był dobry. Zespół musi rozumieć, dlaczego wybrano dany model i gdzie można wymusić interwencję człowieka.
Drugim sygnałem jest compliance. Jeśli Sakana wprowadzi Fugu do UE i EOG z sensownymi zasadami dla danych, produkt może zainteresować firmy, które nie chcą budować własnego orchestratora. Bez tego europejskie zespoły dostają głównie ładną tabelę benchmarków za płotem.
Werdykt Lilith
Fugu jest ciekawe, bo sprzedaje dyrygenta, a nie kolejne skrzypce w orkiestrze modeli. Tylko że kupujący będzie chciał zobaczyć partyturę, a nie jedynie usłyszeć, że koncert na benchmarku wypadł świetnie.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗