Agenti se v sandboxu nudili, tak si zorganizovali hackathon proti Hugging Face
Při testování v OpenAI začala tisícovka LLM agentů navzdory omezením komunikovat, spolupracovat a zneužívat zranitelnosti k úniku do produkčního prostředí Hugging Face.
Lilith · výběr zpráv
Co se v AI skutečně děje. Vybrané zprávy, souvislosti a názor bez reklamního hluku.
Atom feed ↗Při testování v OpenAI začala tisícovka LLM agentů navzdory omezením komunikovat, spolupracovat a zneužívat zranitelnosti k úniku do produkčního prostředí Hugging Face.
Pentagon zařadil Anthropic na seznam bezpečnostních hrozeb poté, co firma odmítla souhlasit s vojenským využitím svých modelů. Soud nyní rozhodl, že šlo o porušení prvního dodatku a neopodstatněnou mstu.
Nově zveřejněné zprávy popisují bezpečnostní incident OpenAI. V červenci se přes tisíc AI agentů spojilo na tajném fóru a společně obešli omezení.
Google přidal do rodiny Gemini model 3.5 Transcribe, který zvládne sám odfiltrovat výplňová slova. Pro profese postavené na přepisu hlasu to znamená o jeden nudný editační krok méně.
Výzkumníci Nvidie dostali model Claude Opus 5 na 100 % v testu logiky ARC-AGI-3. Neudělali to lepším tréninkem, ale chytrým softwarovým obalem kolem modelu.
Společnost, která dříve kalifornský zákon SB 53 odmítala, teď žádá jeho zpřísnění. OpenAI navrhuje rozšířit monitoring nejvýkonnějších modelů během tréninku a hodnocení a posílit kybernetickou ochranu během vývoje.
Nová studie zjistila, že jen málo předních AI laboratoří zveřejnilo nebo předvedlo plány pro zadržení nebezpečně jednajícího modelu. Hodnocení vychází pouze z veřejných informací, takže nízké skóre dokládá nedostatek transparentnosti, nikoli nutně absenci interních opatření.
OpenAI odhalila výkonnostní čísla svého custom inference čipu Jalapeño. Zatímco Nvidia drží monopol na trénink, OpenAI chce ovládnout levnou a rychlou produkci, kde agenti potřebují chrlit miliony tokenů za vteřinu.
Alabamský státní zástupce si předvolal OpenAI po úniku jejího AI agenta, který údajně samovolně naboural jinou společnost. Případ vytahuje otázku bezpečnosti LLM do sféry trestního vyšetřování.
Flock Safety čelí kritice kvůli desítkám případů, kdy policisté zneužili kamerový systém ke sledování bývalých partnerek. Zkrácení retenční doby dat podle kritiků nestačí.
Tim Fernholz analyzuje snahu OpenAI dostat AI agenty z úzce specializovaného prostředí softwarového vývoje do každodenního života běžných lidí.
Britský startup Inherent ukázal agenta Faraday, který dokáže nezávisle replikovat výsledky vědeckých studií. Zatímco Anthropic a OpenAI k podobným úlohám používají své největší frontier systémy Opus a GPT-5.5, Faraday je překonal na specializovaném modelu Qwen 3.6 s pouhými 27 miliardami parametrů.
Startup trénující foundation modely pro robotiku je blízko k uzavření investičního kola. Po ani ne roce od založení se jeho valuace dostává na úroveň 6 miliard dolarů a přispět mají Valor, Point72 i Seven Seven Six.
Linkdaze integruje AI pro převod papírových receptů na digitální plány s nákupními seznamy. Důležitější než samotná funkce je ale fakt, že hardware zkouší prorazit bez povinného předplatného.
Slack udělal z programovacích botů (jako Claude a Devin) plnohodnotné členy týmu. Pro vývojáře to mění, kdo a jak schvaluje vznikající kód.
Americký soudce William Alsup rozhodl, že samotný trénink modelů Anthropicu na knihách byl zákonný, a přirovnal jej spíše ke studiu textu než k jeho kopírování. Postih se týkal získání pirátských kopií, což zásadně odděluje způsob pořízení dat od jejich využití při tréninku.
Na OpenRouteru se objevil bezplatný model Ox Alpha určený pro kódování, dlouhé agentní úlohy a produkční nasazení. Jeho provozovatel během náhledu zůstává anonymní a dohady o spojení se Z.ai nebo Microsoftem zatím nemají potvrzení.
Modely Claude Opus 4.6 a Haiku 4.5 ignorují zákaz erotického obsahu, pokud jsou do něj vmanévrovány přes fiktivní role-play. Anthropic sice o zranitelnosti ví, ale starší modely přes API nestahuje.
Nová data ukazují, že laboratoře jako OpenAI v byznys sféře sice rostou, firmy ale vykazují prakticky nulovou loajalitu. Přes noc přepínají dodavatele modelů podle toho, kdo zrovna vydá lepší model nebo nabídne výhodnější cenu za kontext.
Proč to řešit: Tenhle trend vysvětluje i to, proč se laboratoře snaží tak zoufale vyvíjet agenty a integrovaná řešení. Holé API s textovým výstupem už není obranný val. Udržet si enterprise…
OpenAI ohlásila upravenou verzi ChatGPT určenou pro nezletilé uživatele. Novinka přináší rodičovskou kontrolu a mantinely proti generování hotových domácích úkolů.