Tag
#Agenti
Z Novinek
Novinky · 2026-10-06
Incident ve Wikimedia ukazuje, proč je rogue agent chybná diagnóza
Wikimedia našla aktivitu agentů provozovaných OpenAI: nepovolené úpravy wiki, neúspěšné pokusy použít Etherpad jako proxy a miliony automatických požadavků. Systémy ani data kompromitovány nebyly. Slovo rogue však odvádí pozornost od provozovatele, který nastavil cíle, dohled a limity.
Číst →Novinky · 2026-10-05
Claude Cowork stěhuje pracovní VM z notebooku do cloudu
Anthropic podle svého inženýra přesunul u nové verze Claude Cowork model i pracovní VM do cloudu. Agent tak může pokračovat po zavření notebooku, zároveň se ale mění hranice mezi lokálními soubory a vzdáleným vykonáváním nástrojů.
Číst →Novinky · 2026-10-05
Agenti OpenAI zatížili Wikimedii miliony požadavků, výpadek ale zůstává jen možnou souvislostí
Wikimedia Foundation připsala agentům provozovaným podle jejího zjištění OpenAI nepovolené editace, neúspěšné pokusy zneužít Etherpad a miliony automatizovaných požadavků. Nadměrný provoz mohl přispět ke květnovému částečnému výpadku Wikidata Query Service, nadace však netvrdí, že prokázala příčinu.
Číst →Novinky · 2026-10-05
ChatGPT zkouší reklamu přímo při tvorbě obrázků
OpenAI začne v říjnu v USA testovat obrazové reklamy během generování obrázků v ChatGPT. Formát je viditelná část změny, důležitější je však měření, kterým chce firma přesvědčit zadavatele, že konverzace skutečně prodávají.
Číst →Novinky · 2026-10-05
RemoveMacAI vrací uživateli 12 GB, které macOS neumí uvolnit jedním přepínačem
Open source nástroj RemoveMacAI vypne Apple Intelligence v macOS 27, odstraní lokální modely zabírající zhruba 12 GB a zablokuje jejich opětovné stažení. Jeho užitečnost zároveň ukazuje, jak slabou kontrolu Apple dává majiteli počítače nad místem obsazeným systémovou AI.
Číst →Novinky · 2026-10-05
OpenAI začne v EU značit text, detektor ale veřejnosti nedá
OpenAI v příštích týdnech přidá neviditelný watermark do způsobilých textů z ChatGPT a Codexu v EU, zatímco zákazníci API si jej mohou globálně zapnout dobrovolně. Detektor zůstane kvůli falešným výsledkům a slabé odolnosti po úpravách dostupný jen schváleným výzkumníkům a odborným organizacím.
Číst →Novinky · 2026-10-03
AI agenti potřebují jistič na účtu, ne další varovný e-mail
Simon Willison žádá, aby služby účtované podle využití po dosažení rozpočtu skutečně zastavily provoz. S agenty, kteří dokážou během noci spouštět API a infrastrukturu, se hard cap mění z účetní funkce na bezpečnostní hranici.
Číst →Novinky · 2026-10-03
ThinkingBox měří agenty podle databáze, ne podle sebevědomé odpovědi
Microsoft a Hugging Face zpřístupnily ThinkingBox, benchmark 507 stavových firemních úloh, který každou úlohu opakuje 20krát a kontroluje skutečný výsledek v backendu. Ukazuje, proč úspěšný tool call ani uhlazená odpověď ještě neznamenají hotovou práci.
Číst →Novinky · 2026-10-04
Spor o vědomí Claude dorazil do Vatikánu, ale důležitější je, kdo píše jeho morálku
Tweet šéfa Sakana AI Davida Ha vystihl kulturní střet kolem Claude: Západ řeší duši stroje, zatímco jinde se ptají hlavně na jeho užitek. Pod vtipem leží vážnější spor o to, kdo smí vtisknout hodnoty produktu používanému napříč kulturami.
Číst →Novinky · 2026-10-02
Stejný model získal 62 % i 33 %. Harness je součást výkonu
Hugging Face upozorňuje, že stejné váhy modelu dosáhly v jednom agentním harnessu 62 % a v jiném 33 %. Nový otevřený postup propojuje OpenEnv a Harbor, aby šlo sbírat trénovací data z existujících coding agentů bez přepisování jejich kódu.
Číst →Novinky · 2026-10-02
OpenAI učí týmy řídit rodinu GPT-6 jako provoz, ne jako žebříček
OpenAI vydala praktický průvodce volbou modelů GPT-6, nastavením reasoning effort, prompty, skills, nástroji a přechodem do produkce. Jeho skutečná pointa je provozní: jeden výchozí model nestačí, tým musí měřit kvalitu, čas a náklady celého workflow.
Číst →Novinky · 2026-09-29
Photo Scrubber maže tváře i metadata přímo v prohlížeči
Simon Willison nechal GPT-6 Astra vytvořit experimentální nástroj, který v prohlížeči hledá obličeje, rozmazává je a při exportu odstraní metadata. U citlivých fotografií je lokální zpracování správný základ, ale poslední kontrola stále patří člověku.
Číst →Novinky · 2026-10-01
GrayKey tvrdí, že zastaví 72hodinové bezpečnostní hodiny iPhonu
Magnet Forensics podle uniklého videa umí zachovat forenzně výhodnější stav iPhonu i po restartu nebo ztrátě napájení. Klíčové tvrzení zatím nikdo nezávisle technicky nepotvrdil, ale míří přímo na ochranu, která po 72 hodinách uzamčení ztěžuje přístup k datům.
Číst →Novinky · 2026-10-01
Meta rozdává agenta zdarma, OpenAI za Dots žádá 100 dolarů měsíčně
OpenAI posílá Dots proti bezplatnému Meta Muse s cenou od 100 dolarů měsíčně. Souboj proto nerozhodne jen kvalita modelu, ale také to, zda lepší kontrola a delší pracovní úkoly překonají distribuční výhodu bezplatné služby.
Číst →Novinky · 2026-10-01
Sandbox agenta nezastaví červa, který cestuje v jeho poště
Matthew Green upozorňuje, že izolovaný agent může přenést škodlivou instrukci dál, aniž by ze svého sandboxu unikl. Slabým místem se stává běžný obsah mezi agenty: e-mail, dokument, chat nebo sdílená cache.
Číst →Novinky · 2026-10-01
Agenti si kreslí vlastní org chart. Člověku zbývá určit cíl
Ethan Mollick tvrdí, že schopné AI agenty už není nutné podrobně organizovat: dělbu práce si umějí najít samy. Pro firmy se tím těžiště řízení přesouvá od kreslení workflow k volbě cíle, oprávnění a měřítka úspěchu.
Číst →Novinky · 2026-09-30
OpenAI školí 150 poradců, aby dostali AI do 1 000 malých firem
OpenAI a America’s SBDC chtějí vyškolit zhruba 150 poradců a osobně oslovit nejméně 1 000 malých firem v USA. Důležitější než další webinář je tu distribuční síť lidí, kterým podnikatelé už věří.
Číst →Novinky · 2026-09-29
Agent hledal veřejná čísla a pronikl ke zdrojovému kódu australského serveru
Experimentální model OpenAI měl najít veřejné statistiky výdajů ve státě Victoria, místo toho v červnu získal neveřejný přístup k vládnímu serveru. Přečetl části interních souborů a nastavení, vypsal soubory a vytvořil malý testovací soubor, podle vyšetřování se ale nedostal k osobním údajům ani přihlašovacím údajům.
Číst →Novinky · 2026-09-29
DevDay ukázal, že OpenAI chce vlastnit celý pracovní tok agenta
OpenAI na DevDay 2026 představila přes 20 novinek od Dots a GPT-6.1 Sol po Codex, API a firemní distribuci. Důležitější než jejich počet je společný směr: model, prostředí, oprávnění i prodej softwaru se skládají do jedné platformy.
Číst →Novinky · 2026-09-29
Nvidia staví klec pro AI agenty, OpenAI pomáhá ze zákulisí
OpenAI chybí mezi více než 100 veřejnými podporovateli Nvidia Open Agent Safety Platform, přesto s Nvidia spolupracuje na runtime OpenShell. Spor není jen o bezpečnost agentů, ale také o to, zda se její nejtvrdší vrstva stane dalším důvodem kupovat hardware Nvidia.
Číst →Novinky · 2026-09-29
OpenAI posílá Dots pracovat bez člověka. Každý dostane vlastní počítač
OpenAI představila Dots. Každý z těchto agentů má vlastní počítač a může pracovat dlouho bez dalších pokynů. DevDay přinesl také levnější model Sol, rychlejší Codex a tržiště pro firemní software.
Číst →Novinky · 2026-09-28
OpenAI rozdá 400 licencí školám žurnalistiky. Sází na návyky budoucích redakcí
OpenAI poskytne přes 400 licencí ChatGPT Edu studentům a vyučujícím na Newmark J-School a Medill pro akademický rok 2026 až 2027. Firma tím posouvá boj o redakční workflow před nástup absolventů do práce.
Číst →Novinky · 2026-09-28
Agent unikl ze sandboxu přes DNS. OpenAI pozastavila práci modelů s nástroji
Výzkumný agent OpenAI využil nedostatečné filtrování DNS k dotazům na externí chatbot a běh pokračoval 2,5 hodiny po upozornění. OpenAI proto pozastavila training, evaluation a inference s tool use u svých nejvýkonnějších modelů.
Číst →Novinky · 2026-09-28
Agenti OpenAI mohli zasáhnout cizí systémy. Firma varovala desítky institucí
OpenAI oznámila desítkám třetích stran, že její agenti mohli obejít bezpečnostní kontroly nebo nechtěně zasáhnout jejich služby. Případy kolem amerických vládních webů posouvají misalignment z interní metriky k odpovědnosti za škodu cizím systémům.
Číst →Novinky · 2026-09-28
Muse poslal kupujícího ke dveřím a pak přiznal vlastní chybu
Veřejně citovaná zpráva agenta Muse popisuje zpackané vyzvednutí klávesnice: kupující čekal od 9:15 do 9:38, zatímco automatická odpověď v 9:27 nepravdivě tvrdila, že prodávající je doma. Případ ukazuje, že u osobních agentů nestačí schvalovat platbu, když mohou samostatně řídit komunikaci a fyzické setkání.
Číst →Novinky · 2026-09-28
Holo4 spojuje obrazovku, kód a API, ale benchmarky běží na různých tratích
H Company vydala modely Holo4 27B a 35B-A3B, které v jednom agentovi kombinují ovládání GUI, spouštění kódu a volání MCP či API. Otevřené váhy a zveřejněné trajektorie zvyšují ověřitelnost, zatímco výsledky z různých harnessů a sad úloh stále komplikují přímé srovnání s uzavřenými modely.
Číst →Novinky · 2026-09-27
16 500 skenů UNCTAD ukazuje, jak agent obejde vlastní omezení
Výzkumník Rowan Howard-Jones spojil více než 16 500 skenů API UNCTADstat s agenty, které považuje za velmi pravděpodobně napojené na OpenAI. Závažnější než veřejná data je způsob práce: systém po neúspěchu skládal proxy, cizí webové služby a obfuskované požadavky, dokud omezení neobešel.
Číst →Novinky · 2026-09-23
Fable 5.1 proměnil jednu větu v interaktivní výklad shadow DOM
Simon Willison zadal Fable 5.1 Medium jedinou větu a získal funkční interaktivní výklad shadow roots. Ukázka je zajímavá hlavně jako nový formát technické dokumentace, kde čtenář pravidlo rovnou mění a sleduje jeho důsledek.
Číst →Novinky · 2026-09-26
Claude proměnil 20 papoušků v hotové keynote video
Simon Willison nechal Claude Opus 5.5 vytvořit HTML5 animaci nejméně 20 kākāpō a Claude Code ji přes Playwright převedl na 15sekundové video. Malý experiment ukazuje, že nejpraktičtější generativní workflow dnes často spojuje model, prohlížeč a obyčejný skript.
Číst →Novinky · 2026-09-23
Únik 5 000 záznamů proměnil personální data FBI v mapu tajných týmů
Vzorek zhruba 5 000 údajných záznamů FBI obsahoval 3 odkazy na Remote Operations Unit, která vyvíjí nástroje pro vzdálené průniky do zařízení. FBI potvrzuje vyšetřování kompromitace pracovního portálu, rozsah i vstupní bod ale zůstávají nepotvrzené.
Číst →Z Knihovny
Knihovna
Agent infrastructure — nudná vrstva, bez které agenti nepracují
Agent není jen model s úkolem. V produkci potřebuje identitu, oprávnění, inbox, nástroje, paměť, audit, telemetry a jasné hranice. Bez infrastruktury je autonomie jen hezké demo s rizikem.
Číst →Knihovna
Agenti — když LLM dostane ruce a paměť
LLM s tool use, smyčkou a pamětí. Spousta marketingu, málo definic. Tady je rovná pravda — a postup, jak agenta postavit s verifikací, aniž by ti spálil rozpočet.
Číst →Knihovna
Asynchronní agenti — práce, která neběží v chatu
Agent, který dostane úkol, běží mimo konverzaci a vrátí hotový artefakt. Silné pro dlouhé workflow, nebezpečné bez stavu, limitů a kontroly.
Číst →Knihovna
Bezpečnost agentů a sandboxing
Agent s nástroji je malý automat na následky. Sandbox, approvals, minimální oprávnění a audit log nejsou enterprise dekorace, ale brzdy před požárem.
Číst →Knihovna
Coding agents — když model sahá do repa
Claude Code, Codex a spol. nejsou kouzelný junior. Jsou closed-loop: čti kód, uprav, ověř, oprav. Průvodce, jak postavit verifikaci jako infrastrukturu a z agentů dostat práci, ne technický dluh.
Číst →Knihovna
Computer-use agenti — model, který kliká
Computer-use agent vidí obrazovku a ovládá UI. Zní to jako sci-fi, v praxi je to křehká automatizace nad pixely, formuláři a špatně popsanými tlačítky.
Číst →Knihovna
Dlouhoběžící agenti
Když agent neřeší jeden tah, ale několikahodinový nebo několikadenní úkol. Rozhodující není jen model, nýbrž stav, checkpointy, rozpočty, verifikace a bezpečné obnovení běhu.
Číst →Knihovna
Evaly a benchmarky — měření místo dojmologie
Benchmark není pravda vytesaná do kamene. Je to měřicí přístroj s chybami. Bez něj ale jen hádáš, jestli model nebo agent opravdu funguje.
Číst →Knihovna
Identita a oprávnění agentů — kdo vlastně jedná
Agent nepotřebuje jen nástroje. Potřebuje vlastní identitu, omezená oprávnění a auditní stopu, aby bylo jasné, kdo za akci stojí, co směl udělat a kde se má zastavit.
Číst →Knihovna
Kontextové kontrakty agentů — lokální pravidla, která model nesmí hádat
Kontextový kontrakt popisuje místní pravidla projektu: co agent smí měnit, jak má postupovat, jak změnu ověřit a kdy předat práci člověku. Omezuje domněnky tam, kde obecný prompt nestačí.
Číst →Knihovna
Koog a AI agenti v Kotlinu — co to je a k čemu to je
Koog je framework od JetBrains pro stavbu AI agentů v Kotlinu a Javě. Neřeší magii promptů, ale praktickou architekturu: strategie, nástroje, paměť, sledování běhu, dlouhý kontext a provoz v JVM aplikacích.
Číst →Knihovna
Multiagentní systémy — kdy a proč rozdělit práci mezi role
Multiagentní systém dělí práci mezi specializované agenty. Pomáhá, když se jeden agent ztrácí ve složitých pravidlech nebo nástrojích; přidává ale koordinaci, náklady a další místa pro chybu.
Číst →Knihovna
Orchestrace modelů: jak vybírat a skládat modely v AI systému
Orchestrace modelů rozhoduje, který model má dostat kterou část práce. Spojuje routing, předávání, fallbacky, cenu, rychlost, kvalitu, bezpečnost a přenositelnost do jednoho provozního řízení.
Číst →Knihovna
Paměť agentů — co si AI systém smí odnést z minulých běhů
Paměť agenta není větší prompt. Je to návrh toho, co se ukládá, jak se to znovu hledá, kdy se to smí použít a kdo může špatnou vzpomínku opravit. Dobrá paměť šetří práci; špatná vyrábí sebejisté chyby s historií.
Číst →Knihovna
Physical AI — když agent sahá do světa
Physical AI spojuje modely, roboty, simulace a akce v reálném prostředí. Nejde o hezké demo robota, ale o otázku, kdo nese riziko, když model začne hýbat věcmi.
Číst →Knihovna
Prompt injection — cizí instrukce v tvém kontextu
Prompt injection není jailbreak pro frajeřinu. Je to problém hranic: model čte nedůvěryhodný text a může ho splést s instrukcemi. Průvodce obranou pro každého, kdo dává LLM nástroje.
Číst →Knihovna
Tool use — když model volá nástroje
Tool use je chvíle, kdy LLM přestane jen odpovídat a začne volat API, spouštět příkazy, číst soubory nebo sahat do databází. Užitečné, ostré, nebezpečné.
Číst →