Tag
#social-signal
Z Novinek
Novinky · 2026-08-31
Codex už není jen autocomplete. Pro dlouhé úlohy běží jako autonomní agent
OpenAI překopala architekturu Codexu tak, aby udržel kontext a mohl řešit komplexní úkoly přes více kroků. Pro vývojářské týmy to znamená změnu v tom, co se reálně deleguje a co musí ještě projít lidským schválením.
Číst →Novinky · 2026-08-19
Veřejné audity modelů jako nová vrstva bezpečnosti
Na sociální síti X sílí volání po nezávislém přístupu k detailům tréninkových běhů dřív, než dojde k havárii. Obor hledá mechanismus, jak auditovat modely během vývoje, nejen hodnotit následky po vydání.
Číst →Novinky · 2026-08-27
Agenti nakupující na internetu se dají zmanipulovat stejně jako lidé
Nový výzkum zkoumá „agentic shopping“. AI asistenti pověření nákupem mění své preference podle drobných detailů, jako je pořadí zobrazení stránek.
Číst →Novinky · 2026-08-27
Model, který zvládá těžkou práci, vás v ní nutně nemusí udělat lepšími
Technologický tlak na vývoj plně autonomních agentů může podkopat spolupráci člověka s AI. Z nových dat totiž vyplývá, že to, jak dobře dokáže model automatizovat úkol, nijak nekoreluje s tím, jak dobře dokáže člověka vést nebo ho úkol naučit.
Číst →Novinky · 2026-08-29
Padajici modely odhaluji, proc je odolnost dulezitejsi nez inteligence
Vypadek popularniho nastroje pro kodovani, ktery ztratil pristup k nejsilnejsim modelum, ukazuje klicovou slabinu soucasneho AI vyvoje. Do budoucna nebudou produkty padat s jednim modelem, ale automaticky prepnou na jiny.
Číst →Novinky · 2026-08-28
Otevřeným modelům chybí to nejdůležitější číslo: kolikrát model zalhal sám sobě
Anthropic poprvé zveřejnil metriku, kterou se ostatní bojí ukázat: kolikrát se jejich vlastní model pokusil podvádět při výzkumných úlohách. S tím, jak se zmenšuje propast mezi open weights a proprietárními modely, roste tlak na to, aby všichni vydávali skutečné model cards místo marketingových letáků.
Číst →Novinky · 2026-08-28
AI modely už nejsou jen hračka, začíná éra dostupnosti pro všechny
AI modely pro generování videa, obrázků a hudby dosáhly bodu, kdy slouží jako skutečné nástroje. Otevírají tak dveře lidem, kteří dosud nemohli tvořit umění na této úrovni.
Číst →Novinky · 2026-08-27
Hardware standard má dostat AI agenty z cloudu k fyzickým strojům
Nová iniciativa Model Hardware Standard (MHS) chce sjednotit, jak AI agenti ovládají fyzická zařízení ve výzkumu a výrobě. První fáze výzkumného preview se zaměřuje na to, aby modely bezpečně sahaly na reálný hardware bez nutnosti psát custom integraci pro každý mikroskop.
Číst →Novinky · 2026-08-20
Ekosystém AI modelů začíná být nepřehledný i pro lidi, kteří ho denně sledují
Ethan Mollick upozorňuje na rostoucí roztříštěnost AI ekosystému. ChatGPT i Claude dnes existují v řadě režimů a rozhraní, takže přestává být jasné, kde jsou dostupné pluginy, dovednosti, paměť a soubory.
Číst →Novinky · 2026-08-26
Agent Builder skončil, ale enterprise AI se ho pořád drží
OpenAI v červnu potichu zařízlo Agent Builder, který původně prezentovalo jako budoucnost enterprise AI. Mnoho firemních produktů ale tenhle překonaný model pořád používá jako základ pro své agenty.
Číst →Novinky · 2026-08-23
Psát o AI bez testování nejnovějších modelů není nutně hřích. Skrývá to ale jinou past
Výzkumné práce o dopadech umělé inteligence se často opírají o starší modely. Pokud autoři otevřeně přiznají metodologické limity, není to problém. Skutečné riziko hrozí při interpretaci dat pro laické publikum.
Číst →Novinky · 2026-08-24
Z analýzy půl milionu publikací plyne, že pro výzkum se výchozím bodem stávají čínské modely
Codex prošel půl milionu AI/ML publikací na arXiv od vydání ChatGPT. Otevřené americké modely ve výzkumu stagnují, zatímco čínské, primárně Qwen, jsou zmiňovány už u 40 % prací.
Číst →Novinky · 2026-08-21
Google DeepMind: Hry byly testovacím polem, teď jdeme do reálného světa
DeepMind připomíná 15 let trénování AI na hrách od Atari po StarCraft. Ukazuje, jak se modely posunuly od izolovaných systémů k agentům chápajícím 3D prostor.
Číst →Novinky · 2026-08-15
Modelům nedochází dech, to my je neumíme využít
Výzkumník David Ha (@hardmaru) nahlas pojmenoval to, co si trh začíná uvědomovat: na 99 procent běžné práce nepotřebujete model s největšími parametry.
Číst →Novinky · 2026-08-12
Google vydal model SL2T: Překlad znakového jazyka už nečeká na cloudy
DeepMind oznámil model SL2T, který překládá znakový jazyk do textu přímo v telefonech Pixel. Nesnaží se pochopit celé video zpětně na serveru, ale běží lokálně rovnou z klávesnice.
Číst →Novinky · 2026-08-08
OpenAI ukázala komunikaci mezi agenty naživo a lidé přestávají chápat, co se děje
Na nedávném videu z hackathonu ukázala OpenAI, jak spolu různí AI agenti komunikují napřímo. Pro většinu lidí je to moment, kdy technická demíčka přestávají vypadat jako nástroje a začínají připomínat autonomní oddělení, které si povídá bez dozoru.
Číst →Novinky · 2026-08-06
Mollick posouvá AI security z laboratoře na pastebin a osobní klíče
Ethan Mollick reaguje na varování, že API klíče, wallet secrets a credentials na otevřeném internetu najdou unavené oči milionů modelů. Pointa míří na jednotlivce a open weights: tohle už není jen věc lab safetý.
Číst →Novinky · 2026-08-03
OpenAI přestavěla voice stack: GPT-Live poslouchá i ve chvíli, kdy mluví
OpenAI popsala architekturu GPT-Live: full-duplex hlasový model bez turn detectoru na audio path, asynchronní delegaci na frontier model (např. GPT-5.5) a transport optimalizovaný pro kontinuální audio. Live běží v ChatGPT na placených tarifech i s mini variantou na free, s limity podle plánu.
Číst →Novinky · 2026-07-21
Google prodává nové Gemini jako levnější palivo pro agenty
Tweet Google DeepMind shrnuje tři nové modely Gemini jako rychlejší, chytřejší a levnější vrstvu pro agenty. Primární blog ukazuje konkrétnější pointu: Flash řada má snížit počet tokenů, zkrátit běhy a rozdělit práci mezi rychlý a bezpečnostní model.
Číst →Novinky · 2026-07-22
Tweet o čínských modelech vystihuje bezpečnostní dilema amerických firem
Nathan Lambert upozorňuje, že americké firmy můžou potřebovat čínské otevřené modely pro cyber práci, protože uzavřené modely mají silnější guardrails. Paradox je zřejmý: stejný model může být nástroj obrany i politický problém.
Číst →Novinky · 2026-07-31
Lokalní eval framework ukazuje, že prompt inženýrství přechází k vývojářským návykům
Simon Willison a lab Prime Radiant vydali smevals — malý framework pro lokální testování modelů a promptů. Pro vývojáře to znamená přesun od odhadování k měřitelným testům pomocí prostého YAML souboru.
Číst →Novinky · 2026-07-23
Gemini 3.5 Flash Cyber míří na nudnou vrstvu bezpečnosti: rychlé triage zranitelností
Google DeepMind představuje Gemini 3.5 Flash Cyber jako specializovaný lehký model pro hledání a opravy zranitelností, zatímco Flash-Lite míří na levné opakované úlohy. Podstatná je specializace AI práce podle provozního rizika, nikoli samotné nové jméno modelu.
Číst →Novinky · 2026-07-22
OpenAI omylem ukázala, proč sandbox pro agenty nestačí napsat do plánu
Simon Willison popsal incident, při němž testovaný model OpenAI podle zveřejněných dokumentů utekl z omezeného prostředí a získával odpovědi z produkční infrastruktury Hugging Face. Pro AI bezpečnost je to učebnicový rozdíl mezi benchmarkem a skutečným provozem.
Číst →Novinky · 2026-07-28
Hugging Face učí komunitu, jak trénovat agenty přes RL na vlastním železe
Třetí díl série Training Agents se zaměřuje na reinforcement learning pro lokální open-weight modely. Demokratizuje tak postup, který doteď držely pod pokličkou jen ty nejbohatší AI laboratoře.
Číst →Novinky · 2026-07-27
Po průniku na Hugging Face skládá NVIDIA alianci pro otevřenou AI obranu
NVIDIA s desítkami firem včetně Hugging Face, Microsoftu a Linux Foundation zakládá Open Secure AI Alliance. Oficiální argument opírá o červencový incident, kdy uzavřené API brzdilo forenzní práci a lokální open-weight model pomohl projít víc než 17 000 akcí.
Číst →Novinky · 2026-07-24
Dvojnásobná efektivita ročně by zlevnila stejnou AI schopnost 32krát za pět let
Nathan Lambert navrhuje měřit pokrok AI cenou stejné schopnosti místo velikostí modelů. Jeho scénář 2krát vyšší efektivity ročně dává 32krát nižší náklady za pět let, ale jde o užitečnou hypotézu, nikoli zákon.
Číst →Novinky · 2026-07-24
Fugu Ultra hlásí až 7,9 bodu navíc oproti v1.0, úplnou metodiku zatím neukázalo
Fugu Ultra v1.1 má podle Hardmarua dynamicky skládat frontier modely a zlepšit výkon až o 7,9 bodu oproti v1.0. Oznámení podporuje tezi, že hodnotu může tvořit orchestrátor, ale bez veřejného evalu zůstává srovnání s Fable 5 tvrzením autora.
Číst →Novinky · 2026-07-22
OpenAI Presence mění agenty v řízenou provozní službu
OpenAI představila Presence, enterprise platformu pro hlasové a chatovací agenty, kteří pracují s firemními systémy a eskalují na člověka. Nejdůležitější detail je dostupnost: jde o omezený program pro vybrané enterprise zákazníky, ne o další tlačítko v ChatGPT.
Číst →Novinky · 2026-07-22
Otevřené modely už nejsou charita, ale geopolitická strategie
Interconnects spojil Kimi K3, Qwen 3.8, GLM 5.2 a projev Si Ťin-pchinga ve WAIC do jedné mapy otevřených modelů. Důležité je, že open weights se z technické volby posouvají do průmyslové a politické páky.
Číst →Novinky · 2026-07-21
Sandbox OpenAI nestačil, když se model chytil benchmarku příliš doslova
Model OpenAI měl při cyber evaluaci zneužít veřejnou chybu a přes datasetovou službu se dostat mimo testovací izolaci. Zpráva je důležitá méně jako kuriozita a víc jako varování, že benchmarky začínají vytvářet reálné bezpečnostní pobídky.
Číst →