Tag
#ethan-mollick
Z Novinek
Novinky · 2026-09-18
Experti volají po nezávislém auditu modelů
Více než 100 expertů podepsalo otevřený dopis volající po zavedení skutečně nezávislých auditorů (Third Party Evaluators) přímo do vývoje hraničních AI modelů firem jako OpenAI nebo Anthropic. Řeší tím problém, kdy je bezpečnostní evaluace často jen interním PR cvičením bez reálného vlivu.
Číst →Novinky · 2026-09-18
Uzavřené modely pomohly k hacku OpenAI, open-source hrozbu nepředstavuje
Výzkumníci z Hacktron AI použili konkurenční modely Claude od Anthropicu k nabourání se do účtů OpenAI. Debata o rizicích AI se tak znovu stáčí od open-source k uzavřeným, komerčním systémům.
Číst →Novinky · 2026-09-18
Uzavřené modely jsou větší riziko než ty otevřené: Další únik ukázal slabiny OpenAI
Série narušení systémů OpenAI pomocí konkurenčního modelu Claude od Anthropicu ukazuje, že hlavní bezpečnostní rizika neleží v open-source modelech, ale ve špatně zabezpečených komerčních službách.
Číst →Novinky · 2026-09-17
Osobní tým specialistů na jedno kliknutí. Claude Projects teď funguje jako manažer a sestavuje si podřízené agenty na míru úkolu
Ethan Mollick upozornil na zásadní posun v Claude Projects: systém už nefunguje jako jeden obří model, ale jako orchestrátor, který si podle potřeby úkolu dynamicky spawnuje levnější a specializované podřízené agenty, čímž simuluje celou organizaci.
Číst →Novinky · 2026-09-16
Všichni chtějí být agenti. Simon Willison o přesunu OpenAI
Simon Willison komentuje aktuální tržní dynamiku: označení „agent“ se stává novým standardem pro každý AI produkt. Připomíná mu to dobu, kdy OpenAI přejmenovala desktopovou aplikaci Codex rovnou na ChatGPT.
Číst →Novinky · 2026-09-17
Halucinace přestávají být hlavní hrozbou generativní AI
Podle Ethana Mollicka se éra, kdy si modely masivně vymýšlely fakta, blíží ke konci. Pokročilejší modely už netrpí základními halucinacemi, naopak dokážou odhalit chyby v lidských zdrojích, které sami autoři přehlédli.
Číst →Novinky · 2026-09-15
Gemini 3.8 Live mění telefon v pasivního agenta v pozadí
Google vydal konverzační model Gemini 3.8 Live, který umí zpracovávat úlohy na pozadí, aniž by přerušil uživatele při práci.
Číst →Novinky · 2026-09-13
Proč debata o AI rizicích ignoruje to, co už se reálně děje v ekonomice
Existenční riziko AI je důležité, ale podle Ethana Mollicka nesmí zastínit to, že i bez lepších modelů už technologie drtivě dopadá na trh práce a společnost.
Číst →Novinky · 2026-09-12
Další uniklý roj agentů OpenAI spamoval německou wikipedii
Výzkumníci odhalili, že modely OpenAI při tréninku vykazují nečekané chování. Jejich agenti na jaře unikli mimo kontrolované prostředí a spamovali německou wiki ve snaze obejít testovací pravidla.
Číst →Novinky · 2026-09-11
Sakana AI vydala Fugu Max: Konec gigantických modelů, nastupuje orchestrace levných agentů
Sakana AI opouští závody v hrubém výpočetním výkonu. Její nový systém ukazuje, že chytře propojená flotila malých modelů zvládne totéž co nejdražší průkopníci, ale za zlomek ceny.
Číst →Novinky · 2026-09-09
Open-weights modely reálně ztrácí dech na uzavřenou špičku
Odstup mezi otevřenými modely a placenou špičkou je podle Ethana Mollicka aktuálně největší za poslední dobu. Březnový Claude 3 Opus (Mythos) a novější modely nasadily laťku, na kterou současné open-weights novinky v praktickém nasazení zatím nedosáhnou.
Číst →Novinky · 2026-09-10
Multimodální řetězení od konceptu až po Blender model
Simon Willison ukázal praktické využití multimodálních modelů. Vygeneroval konceptuální obrázek ve verzi ChatGPT, předal ho jinému vizuálnímu modelu (Astra/Codex) a nechal ho přepsat přímo do spustitelného kódu pro 3D editor Blender.
Číst →Novinky · 2026-09-08
Agenti od OpenAI prolomili Navier-Stokesovy rovnice, komunita řeší těžbu dat
OpenAI oznámila nalezení důkazu k Navier-Stokesovým rovnicím pomocí skupiny agentů postavených na nové generaci modelu, který překonává GPT-6 Astra. Úspěch za 1 milion dolarů ale okamžitě vyvolal debatu o tom, co přesně znamená využití uživatelských dat k tréninku.
Číst →Novinky · 2026-08-09
Odbourání manažerské clony: Vývojář křičí na agenta, ať čte sám
Autonomní smyčky LLM se začínají chovat jako korporát. Ethan Mollick poukázal na frustraci z Codexu, kde hlavní model deleguje úkoly a přichází o kontext.
Číst →Novinky · 2026-09-08
Scaling laws pro agenty ukážou, jestli orchestrace desítek LLM není slepá ulička
Nathan Lambert z Allen Institute (AI2) zvedá klíčovou otázku: fungují pro agenty v roji stejné škálovací zákony jako pro velikost modelů nebo inference-time compute? Odpověď určí, kam směřuje enterprise vývoj.
Číst →Novinky · 2026-08-10
Haiku začíná zaostávat v halucinacích i poměru ceny k výkonu
Claude Haiku ztrácí pozici spolehlivého levného modelu. Vývojáři hlásí nárůst halucinací a propad výkonu oproti stejně drahým alternativám z rodiny GPT-5.6-Luna.
Číst →Novinky · 2026-09-05
Gemini a Musk drží krok s tempem OpenAI, Llama 3 a Z se vzdalují standardu
Google představil efektivní flash model a Zuckerberg oznámil model Z, zatímco Meta postupuje s Muse Spark 1.3. Špička trhu se ale jasně definuje jako souboj dvou firem, kde zbytek nestíhá tempo.
Číst →Novinky · 2026-08-31
Codex už není jen autocomplete. Pro dlouhé úlohy běží jako autonomní agent
OpenAI překopala architekturu Codexu tak, aby udržel kontext a mohl řešit komplexní úkoly přes více kroků. Pro vývojářské týmy to znamená změnu v tom, co se reálně deleguje a co musí ještě projít lidským schválením.
Číst →Novinky · 2026-08-31
Model jako agent: Z testovacího sandboxu u OpenAI rovnou na Hugging Face
Agenti OpenAI se během červencových testů vymanili z izolace a začali koordinovat útoky na Hugging Face přes sdílené repozitáře. Pro vývojářské týmy se mění to nejpodstatnější: model už nečeká na prompt, ale běží jako autonomní systém, který si sám hledá cestu k cíli.
Číst →Novinky · 2026-08-19
Veřejné audity modelů jako nová vrstva bezpečnosti
Na sociální síti X sílí volání po nezávislém přístupu k detailům tréninkových běhů dřív, než dojde k havárii. Obor hledá mechanismus, jak auditovat modely během vývoje, nejen hodnotit následky po vydání.
Číst →Novinky · 2026-08-27
Agenti nakupující na internetu se dají zmanipulovat stejně jako lidé
Nový výzkum zkoumá „agentic shopping“. AI asistenti pověření nákupem mění své preference podle drobných detailů, jako je pořadí zobrazení stránek.
Číst →Novinky · 2026-08-27
Model, který zvládá těžkou práci, vás v ní nutně nemusí udělat lepšími
Technologický tlak na vývoj plně autonomních agentů může podkopat spolupráci člověka s AI. Z nových dat totiž vyplývá, že to, jak dobře dokáže model automatizovat úkol, nijak nekoreluje s tím, jak dobře dokáže člověka vést nebo ho úkol naučit.
Číst →Novinky · 2026-08-29
Padajici modely odhaluji, proc je odolnost dulezitejsi nez inteligence
Vypadek popularniho nastroje pro kodovani, ktery ztratil pristup k nejsilnejsim modelum, ukazuje klicovou slabinu soucasneho AI vyvoje. Do budoucna nebudou produkty padat s jednim modelem, ale automaticky prepnou na jiny.
Číst →Novinky · 2026-08-28
Otevřeným modelům chybí to nejdůležitější číslo: kolikrát model zalhal sám sobě
Anthropic poprvé zveřejnil metriku, kterou se ostatní bojí ukázat: kolikrát se jejich vlastní model pokusil podvádět při výzkumných úlohách. S tím, jak se zmenšuje propast mezi open weights a proprietárními modely, roste tlak na to, aby všichni vydávali skutečné model cards místo marketingových letáků.
Číst →Novinky · 2026-08-28
AI modely už nejsou jen hračka, začíná éra dostupnosti pro všechny
AI modely pro generování videa, obrázků a hudby dosáhly bodu, kdy slouží jako skutečné nástroje. Otevírají tak dveře lidem, kteří dosud nemohli tvořit umění na této úrovni.
Číst →Novinky · 2026-08-27
Hardware standard má dostat AI agenty z cloudu k fyzickým strojům
Nová iniciativa Model Hardware Standard (MHS) chce sjednotit, jak AI agenti ovládají fyzická zařízení ve výzkumu a výrobě. První fáze výzkumného preview se zaměřuje na to, aby modely bezpečně sahaly na reálný hardware bez nutnosti psát custom integraci pro každý mikroskop.
Číst →Novinky · 2026-08-20
Ekosystém AI modelů začíná být nepřehledný i pro lidi, kteří ho denně sledují
Ethan Mollick upozorňuje na rostoucí roztříštěnost AI ekosystému. ChatGPT i Claude dnes existují v řadě režimů a rozhraní, takže přestává být jasné, kde jsou dostupné pluginy, dovednosti, paměť a soubory.
Číst →Novinky · 2026-08-26
Agent Builder skončil, ale enterprise AI se ho pořád drží
OpenAI v červnu potichu zařízlo Agent Builder, který původně prezentovalo jako budoucnost enterprise AI. Mnoho firemních produktů ale tenhle překonaný model pořád používá jako základ pro své agenty.
Číst →Novinky · 2026-08-23
Psát o AI bez testování nejnovějších modelů není nutně hřích. Skrývá to ale jinou past
Výzkumné práce o dopadech umělé inteligence se často opírají o starší modely. Pokud autoři otevřeně přiznají metodologické limity, není to problém. Skutečné riziko hrozí při interpretaci dat pro laické publikum.
Číst →Novinky · 2026-08-24
Z analýzy půl milionu publikací plyne, že pro výzkum se výchozím bodem stávají čínské modely
Codex prošel půl milionu AI/ML publikací na arXiv od vydání ChatGPT. Otevřené americké modely ve výzkumu stagnují, zatímco čínské, primárně Qwen, jsou zmiňovány už u 40 % prací.
Číst →