Lilith.
⌕
Redakční ilustrace: 719 matematických rukopisů, dva slíbené open-weight modely a další odchod z AI safety
Ilustrace Lilith · redakční remix

Last Week in AI tento týden mapuje tři různé příběhy o ověřitelnosti. OpenAI ukázala stovky matematických výsledků bez modelu, dva západní týmy oznámily open-weight modely bez okamžitě dostupných vah a bezpečnostní výzkumník popsal limity interního řízení rizik.

OpenAI zveřejnila 719 rukopisů, ale model zůstal neveřejný

Ve veřejném repozitáři bylo v době přehledu 719 rukopisů rozdělených do 372 tematických rodin. Část důkazů má formalizaci v Leanu a OpenAI přidala 10 shrnutí postupu modelu, odhady výpočetních nákladů a statistiky řešených úloh. Samotný frontier model firma nezpřístupnila.

OpenAI uvedla, že zveřejnění konzultovala s Advisory Group on Mathematics and Artificial Intelligence při Institute for Advanced Study. Tato skupina dříve doporučila zveřejňovat název modelu, prompty a výpočetní náklady a varovala před testováním pokročilých problémů na proprietárních modelech, které vědecká obec nemůže použít.

Mistral a Reflection prodávají kontrolu, váhy mají přijít později

Mistral představil multimodální Mistral Large 4 s 1 bilionem parametrů a 49 miliardami aktivních parametrů. Reflection AI ukázala textový Beam s 501 miliardami parametrů, z nichž je 23 miliard aktivních. Obě firmy modely rámují jako západní alternativu k čínským open-weight systémům.

V okamžiku oznámení však váhy ani jednoho modelu nebyly ke stažení. Mistral spustil moderované API a plánoval zveřejnění vah na říjen. Reflection přijímala zájemce o předběžný přístup a rovněž slíbila váhy, technickou zprávu a model card později v měsíci. Pro firmy a státní správu je lákadlem provoz pod vlastní kontrolou, ale zatím jde o příslib, ne o ověřenou vlastnost.

Odchod bezpečnostního výzkumníka vrací pozornost k interním pobídkám

David Robinson odešel z OpenAI po třech a půl letech. Uvedl, že vedl přípravu současného Preparedness Framework a dohlížel na bezpečnostní zprávy k 12 frontier modelům. Ve svém textu kritizoval kulturu, která podle něj opravuje ochrany až po nalezení problému.

Jeho argument nelze ověřit benchmarkem a představuje pohled odcházejícího zaměstnance. Přesto doplňuje oba technické příběhy: repozitář, model card ani otevřené váhy samy neukazují, jak firma řeší konflikt mezi rychlostí vydání a opatrností.

Nezávislé kontroly musí následovat po každém ze tří oznámení

U matematiky rozhodne odborné posouzení rukopisů a reprodukce formalizovaných důkazů. U Mistralu a Reflection bude zásadní, zda váhy skutečně dorazí, pod jakou licencí a zda nezávislé evals zopakují uváděné výsledky.

U bezpečnosti je signálem reakce firmy: zda Robinsonovu kritiku přeloží do měřitelných změn procesu, nebo zůstane jen další veřejnou rezignací. Tento přehled proto funguje jako mapa tří kontrolních bodů, ne jako jeden velký příběh o celém trhu.

Lilithin verdikt

Ve skladu leží 719 rukopisů, vedle nich dvě zavřené krabice s nápisem open-weight a na odchodu člověk, který hlídal bezpečnost. Tento týden nepřinesl jednu odpověď, ale tři fronty pro nezávislé kontrolory.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗ ↗