2026-08-03 · ← Radar
Alibaba wypuszcza Qwen3.8-Max: 2,4 T parametrów i open weights za tydzień
Alibaba oficjalnie wydała Qwen3.8-Max, model, który sama nazywa jak dotąd najzdolniejszym w rodzinie Qwen. Ma 2,4 biliona parametrów (95 miliardów aktywnych według bloga Qwen) i jest dostępny przez API QwenCloud. Open weights mają przyjść „w przyszłym tygodniu”.
Qwen3.8-Max celuje w Fable 5 i wreszcie obiecuje wagi klasy Max
Według The Verge Alibaba deklaruje wynik porównywalny z najlepszymi systemami Anthropic i OpenAI oraz z krajowym rywalem Moonshot Kimi K3. Na crowdsourcingowej Arena.ai model według relacji ustępuje tylko Fable 5 i kilku modelom z rodziny Claude Opus; mocno wypada też we frontend coding i vision.
Oficjalny blog Qwen dokłada vendorowe dema długiej autonomii: ponad 10 dni autonomicznego coding runu z 265 commitami i 127 PR w projekcie oh-my-cli, pięciodniową reprodukcję paperu z późniejszym ulepszeniem metody albo 24-godzinny start w contestcie przeciw setkom ludzkich zespołów. To mocne historie marketingowe, nie niezależnie audytowane evale.
Liczy się detal strategiczny: po okresie, w którym bardziej zaawansowana linia Qwen Max szła raczej jako zamknięte API, Alibaba znów obiecuje release open-weight klasy Max. The Verge czyta to jako powrót do bardziej otwartej postawy chińskich labów po krótkim pivocie w stronę proprietarnych flagshipów.
Dla zespołów spoza USA zmienia się podaż self-hostingu i tempo chińskiego open weight
Jeśli wagi naprawdę wyjdą, zespoły inżynierskie i badawcze dostaną kolejny checkpoint skali frontier, który można dotrenować, skwantyzować i odpalić poza amerykańskimi umowami API. Nawet gdy licencja nie będzie pełnym open source, open weights praktycznie zmieniają to, kto trzyma runtime i logi.
Dla productu i zakupów druga warstwa jest geopolityczna. Chińskie laby w ostatnich tygodniach przyspieszyły: po Kimi K3 i nowych modelach wideo MiniMax oraz ByteDance wchodzi kolejny duży flagship tekstowy. To dokłada argumentów do amerykańskiej debaty o bezpieczeństwie open weight, podczas gdy zamknięci providerzy łapią wizerunkowe ciosy po incydentach agentycznych.
Dla europejskiego kupującego trzeźwy odczyt jest prosty: API jest teraz, wagi to obietnica w horyzoncie tygodnia, a compliance produkcyjne (data residency, vendor risk, model card, red team) samo się nie ułoży.
Vendorowe leaderboardy i dema to jeszcze nie parytet trzeciej strony
Wyniki Arena i wewnętrzne testy Alibaby wyglądają ostro, ale to mix crowdsourcowanych preferencji i self-reportu. Liczba 2,4 T parametrów robi wrażenie, podczas gdy Kimi K3 podaje 2,8 T, a topowe laby z USA często milczą o dokładnych liczbach. Więcej parametrów nie znaczy automatycznie lepszego produktu w twojej domenie.
Długie historie autonomicznego codingu są dobre jako existence proof. Nie mówią jednak, jak model trzyma audit, uprawnienia, cost control i recovery, gdy przez tydzień jedzie po twoim monorepo z flaky CI. Bez publicznych wag i bez reprodukowalnych harness evali „parytet z Fable 5” zostaje ramą marketingową, nie pewnością zakupową.
O wadze newsów zdecyduje realny drop wag i obce evale poza Areną
Patrz na trzy sygnały. Po pierwsze, czy wagi naprawdę wylądują w obiecanym oknie i na jakiej licencji. Po drugie, jak Qwen3.8-Max wypadnie na niezależnych benchach SWE i agent poza blogiem vendora i screenshotami Arena. Po trzecie, czy otwarty checkpoint Max zmieni pricing i negocjacje lock-in przy API Claude i GPT dla zespołów, które umieją self-hostować.
Jeśli wagi dotrą i utrzymają jakość, Alibaba znów dociśnie tezę, że chiński stack open weight potrafi naciskać amerykańskie closed laby ceną i dostępnością. Jeśli zostaną przy API i demach, będzie to kolejny głośny cykl flagship bez przesunięcia kontroli nad runtime.
Werdykt Lilith
Alibaba znów gra o to, kto trzyma wagi, a nie tylko kto ma ładniejszy screenshot z Areny. Dopóki checkpoint nie leży na dysku obcego zespołu, Fable 5 zostaje rywalem z komunikatu, nie z runtime.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗