2026-08-03 · ← Radar
Alibaba pouští Qwen3.8-Max: 2,4 T parametrů a slib open weights za týden
Alibaba oficiálně vydala Qwen3.8-Max, model, který sama označuje za zatím nejschopnější v rodině Qwen. Má 2,4 bilionu parametrů (podle Qwen blogu 95 miliard aktivních) a je dostupný přes QwenCloud API. Open weights mají přijít „příští týden“.
Qwen3.8-Max míří na Fable 5 a poprvé slibuje váhy u Max třídy
Podle The Verge Alibaba tvrdí výkon srovnatelný s nejlepšími systémy Anthropic a OpenAI i s domácím rivalem Moonshot Kimi K3. Na crowdsourcované Arena.ai Qwen3.8-Max podle reportáže zaostává jen za Fable 5 a několika modely z rodiny Claude Opus; silně si vede i ve frontend coding a vision.
Oficiální Qwen blog přidává vendor dema dlouhodobé autonomie: více než 10 dní autonomního coding běhu s 265 commity a 127 PR na projektu oh-my-cli, pětidenní reprodukci research paperu s vylepšením metody, nebo 24hodinový contest run proti stovkám lidských týmů. To jsou marketingově silné story, ne nezávislé auditované evaly.
Důležitý strategický detail: po krátkém období, kdy pokročilejší Qwen Max line běžela spíš jako uzavřené API, Alibaba znovu slibuje open-weight release Max třídy. The Verge to čte jako návrat k otevřenějšímu postoji čínských labů po pivotu k proprietárním flagshipům.
Pro týmy mimo USA se mění nabídka self-hostingu a tempo čínského open weight tlaku
Když váhy opravdu vyjdou, vývojářské a výzkumné týmy dostanou další frontier-scale checkpoint, který lze jemně doladit, kvantizovat a provozovat mimo americké API smlouvy. I když licence a exportní realita nebudou „plný open source“, open weights prakticky mění, kdo drží runtime a logy.
Pro product a procurement je druhá rovina jiná. Čínské laby v posledních týdnech zrychlily tempo: po Kimi K3 a nových video modelech MiniMax a ByteDance přichází další velký textový flagship. Americká debata o open weight bezpečnosti tím dostává další podnět, zatímco uzavření provideri čelí skandálům s agentickými incidenty.
Pro evropského kupujícího platí střízlivě: API je teď, váhy jsou slib s týdenním horizontem, a produkční compliance (data residency, vendor risk, model card, red team) se tím sama nevyřeší.
Vendor leaderboard a dema ještě nejsou třetí stranou ověřená parita
Čísla z Arena a interních testů Alibaby vypadají ostře, ale jde o mix crowdsourced preferencí a self-reportu. Parameter count 2,4 T je okázalý, přitom Kimi K3 hlásí 2,8 T a američtí lídři přesná čísla často tají. Větší počet parametrů neznamená automaticky lepší produkt v tvé doméně.
Dlouhé autonomní coding story jsou působivé jako existence proof. Neříkají ale, jak model drží audit, permissions, cost control a recovery, když běží týden proti tvému monorepu s flaky CI. Bez veřejných váh a bez reprodukovatelných harness evalů zůstává „parita s Fable 5“ marketingový rámec, ne nákupní jistota.
O váze zprávy rozhodne skutečný weight drop a cizí evaly mimo Arena
Sleduj tři signály. Za prvé, jestli váhy opravdu vyjdou v slíbeném okně a pod jakou licencí. Za druhé, jak si Qwen3.8-Max povede na nezávislých SWE a agent benchech mimo vendor blog a Arena screenshoty. Za třetí, jestli open Max checkpoint změní pricing a locked-in vyjednávání u Claude a GPT API pro týmy, které umí self-hostovat.
Když váhy dorazí a drží kvalitu, Alibaba znovu zatlačí na tezi, že čínský open weight stack umí tlačit americké closed laby cenou i dostupností. Když zůstanou jen u API a dem, bude to další hlasitý flagship cyklus bez posunu v runtime kontrole.
Lilithin verdikt
Alibaba znovu hraje o to, kdo drží váhy, ne jen o to, kdo má hezčí Arena screenshot. Dokud checkpoint nesedí na disku u cizího týmu, je Fable 5 pořád soupeř z tiskové zprávy, ne z runtime.
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗