Lilith Lilith.
CS EN PL

Ethan Mollick v letní edici průvodce One Useful Thing říká prakticky jednu věc: pokud chcete reálnou práci, ne jen recept nebo dopis, berte Claude nebo ChatGPT a dejte agentovi počítač. Simon Willison ten posun přepsal jako signál, že se za rok z výběru chat modelu stala volba agentického systému a oprávnění.

Mollick už neřadí chaty, ale kdo smí řídit hodiny práce

Mollick píše, že „používat AI“ dřív znamenalo konverzaci s modelem. Teď znamená agentický systém, který zvládne ekvivalent mnoha hodin lidské práce najednou, protože spojuje model s nástroji a plánováním. Pro nízké sázky stačí volné chaty. U zdravotních nebo právních otázek chce nejpokročilejší dostupné modely a vyšší thinking level.

Pro reálnou práci vidí pro většinu lidí jen dvě cesty: ChatGPT nebo Claude, od zhruba 20 dolarů měsíčně. Google v jeho seznamu spadl: nemá etablovaný vstup do kategorie Codex / ChatGPT Work / Cowork a Gemini Spark se teprve musí prokázat. Open-weight modely z Číny označuje za překvapivě schopné, ale pro agenty vyžadují expertizu.

Pro tým se mění nákup: ne model, ale harness a schvalování

Mollick rozlišuje dvě vrstvy. Firemní virtuální počítač (ChatGPT Work, Claude Cowork) umí dlouhé úlohy i ze mobilu a napojení na e-mail nebo Drive. Silnější cesta je lokální appka s přístupem k vašemu stroji: Work a Codex u ChatGPT, Cowork a Code u Claude. Názvy se překrývají a nemapují se 1:1, Willison to označuje za spektakulárně neintuitivní.

Praktický rozdíl je v tom, co smí agent odeslat, koupit nebo smazat. Mollick popisuje, jak ChatGPT po dřívějším svolení odeslal e-mail kolegům, zatímco Claude nechal draft ke schválení. Default má zůstat „zeptej se před akcí“, i kvůli prompt injection z e-mailu a webu. Poznámka k tarifu: 20dolarové plány dávají reálné, ale omezené agent hodiny. Dražší tarify hlavně kupují víc práce, ne chytřejší model.

Demo ukáže happy path, provoz ukáže limity oprávnění a názvů

Průvodce je silný jako mapa produktů a slabší jako nákupní checklist pro firmu v EU. Dostupnost agent režimů, computer use a napojení na interní systémy se liší podle regionu, tarifu a IT politiky. Mollick píše z pozice uživatele, který agentům dává Gmail a část Drive. To není výchozí stav ve firmě s compliance.

Willison doplňuje další vrstvu zmatku: ChatGPT Work na mobilu a Work v desktop appce se chovají jinak. Když uživatel nechápe, jestli agent běží ve sandboxu dodavatele nebo na jeho notebooku, schvalovací politiky se stávají divadlem. Computer use s myší a prohlížečem Mollick sám označuje za bezpečnostní riziko, které stojí za opatrnost.

Ukáže se to na review frontě a na tom, co smí odejít bez člověka

Důkazem nebude další srovnávací tabulka modelů. Ukáže se to na tom, jestli tým dokáže popsat úkol, rozdělit kontext a nechat schvalovat jen odeslání, platbu a mazání. Sledujte, jestli se jmenování režimů u OpenAI a Anthropicu zjednoduší, jestli Google dodá srovnatelný agent harness a jestli 20dolarové limity agent hodin stačí na týdenní provoz, nebo lidi tlačí do vyšších plánů dřív, než jim model dojde dech.

Lilithin verdikt

Mollick už neprodává tip na chat. Prodává směnu, ve které juniorní analytik dostane notebook dodavatele a vy musíte dopředu říct, jestli smí odeslat mail kolegovi.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗