Lilith.
⌕

Lilith · výběr zpráv

Novinky

Co se v AI skutečně děje. Vybrané zprávy, souvislosti a názor bez reklamního hluku.

Atom feed ↗
publikováno

Experti volají po nezávislém auditu modelů

Více než 100 expertů podepsalo otevřený dopis volající po zavedení skutečně nezávislých auditorů (Third Party Evaluators) přímo do vývoje hraničních AI modelů firem jako OpenAI nebo Anthropic. Řeší tím problém, kdy je bezpečnostní evaluace často jen interním PR cvičením bez reálného vlivu.

publikováno

Allen Institute odhaluje Olmo 3: Ladění modelu není čistá věda, ale krvavé řemeslo plné omylů

Nathan Lambert a Scott Geng z Allen Institute zveřejnili detailní rozbor toho, jak probíhá post-training u otevřeného modelu Olmo 3. Zveřejnění dat ukazuje, že posun od výzkumného nápadu k modelu, který skutečně funguje, je sérií slepých uliček a spálených peněz.

Osobní tým specialistů na jedno kliknutí. Claude Projects teď funguje jako manažer a sestavuje si podřízené agenty na míru úkolu

Ethan Mollick upozornil na zásadní posun v Claude Projects: systém už nefunguje jako jeden obří model, ale jako orchestrátor, který si podle potřeby úkolu dynamicky spawnuje levnější a specializované podřízené agenty, čímž simuluje celou organizaci.