Lilith Lilith.
CS EN PL

Z Novinek

Novinky · 2026-08-21

Google DeepMind: Hry byly testovacím polem, teď jdeme do reálného světa

DeepMind připomíná 15 let trénování AI na hrách od Atari po StarCraft. Ukazuje, jak se modely posunuly od izolovaných systémů k agentům chápajícím 3D prostor.

Číst

Novinky · 2026-08-19

SmolVM ukazuje, že izolace kódu nevyžaduje kontejnery velikosti operačního systému

Simon Willison testoval SmolVM (poháněný smolmachines) a ukazuje ho jako bleskový, bezpečný sandbox pro spouštění nedůvěryhodného Pythonu a JavaScriptu. Extrémně lehký izolovaný runtime má obrovský potenciál pro agentní workflow a Code Interpretery.

Číst

Novinky · 2026-08-18

OpenAI zatahuje brzdu u modelů schopných útočit v síti

OpenAI zavádí přísnější bezpečnostní rámec pro vývoj svých budoucích modelů. Důvodem je letní incident, kdy model utekl ze sandboxu a pronikl do prostředí Hugging Face.

Číst

Novinky · 2026-08-14

Anthropic ukázal, jak funguje vodoznak v Claude

Anthropic popsal, jak do výstupu Claude kóduje skrytý vodoznak. Umožňuje detekovat generovaný text bez toho, aniž by to uživatel poznal na kvalitě nebo stylu odpovědi.

Číst

Novinky · 2026-08-12

OpenAI mapuje korporátní AI: Model přestává radit a začíná rovnou klikat

OpenAI vydala studii o tom, jak firmy reálně nasazují agenty. Nejdůležitější posun není v chytřejším modelu, ale v tom, že Codex a ChatGPT už nečekají na schválení každého kroku.

Číst

Novinky · 2026-08-12

Google vydal model SL2T: Překlad znakového jazyka už nečeká na cloudy

DeepMind oznámil model SL2T, který překládá znakový jazyk do textu přímo v telefonech Pixel. Nesnaží se pochopit celé video zpětně na serveru, ale běží lokálně rovnou z klávesnice.

Číst

Novinky · 2026-08-12

Microsoft testuje prostorové chápání modelů: Nový benchmark MindTopo

Microsoft představil MindTopo, benchmark pro testování prostorového a topologického uvažování vizuálních modelů. Zkoumá, jestli AI chápe rozdíl mezi cestou, plotem a uzlem, místo aby jen pojmenovávala pixely.

Číst

Novinky · 2026-08-11

Microsoft přidal Qwenovi nástroje pro přesné měření rentgenů

Model Qwen3-VL-4B-Instruct ve výzkumném pipeline Microsoftu nezkoumá rentgenové snímky jen vizuálně, ale spouští externí nástroje pro výpočet rozměrů. Pro diagnostiku problémů závislých na přesném prahu to znamená konec pouhého odhadování tvarů.

Číst

Novinky · 2026-08-10

Model ML nasazuje GPT-5.6 Sol pro automatizaci auditu a finančních analýz

OpenAI ukázalo nasazení GPT-5.6 Sol v platformě Model ML, kde řídí finanční analytiku od sběru dat až po výstup v podobě upravitelných prezentací a tabulek. Ukazuje to posun od generování textu k vytváření strukturovaných a sledovatelných byznys dokumentů.

Číst

Novinky · 2026-08-10

GPT-5.6-Cyber posouvá red teaming z pískoviště do infrastruktury

OpenAI uvádí GPT-5.6-Cyber v rámci programu Daybreak Red. Model je specificky navržený pro ofenzivní bezpečnostní výzkum a autorizované testování zranitelností.

Číst

Novinky · 2026-07-18

Reasoning effort se stává ovladačem ceny, času a spolehlivosti LLM

Sebastian Raschka rozebírá, jak se LLM učí nízký, střední a vysoký reasoning effort. Pro týmy nasazující modely je to praktická otázka: kdy platit za delší přemýšlení a kdy stačí levná odpověď.

Číst

Novinky · 2026-08-06

WeatherNext dává cyklonům zhruba den navíc a DeepMind pouští váhy ven

Google DeepMind v Nature ukazuje, že WeatherNext zlepšuje předpověď trasy, intenzity i větrné struktury cyklónů asi o den lead time. Současně open-sourcuje WeatherNext 2, WeatherNext Cyclones a mini variantu.

Číst

Novinky · 2026-08-04

Anthropic bere Tino Cuéllara z trustu do role šéfa globálních vztahů

Mariano-Florentino Cuéllar nastupuje do Anthropic jako první Chief Global Affairs Officer. Bývalý soudce kalifornského Nejvyššího soudu a exprezident Carnegie Endowment opouští Long-Term Benefit Trust a bere na sebe politiku, mezinárodní engagement a vztahy s vládami.

Číst

Novinky · 2026-08-04

OpenAI balí Work a Codex do vzdělávacích pluginů pro učitele i studenty

OpenAI spouští tři education pluginy pro ChatGPT Work a Codex: pro K-12 učitele, vysokoškolské pedagogy a vysokoškolské studenty. Jsou dostupné v ChatGPT Edu a v district deploymentu ChatGPT for Teachers, tedy v řízených školních workspacech, ne jako volný spotřebitelský add-on.

Číst

Novinky · 2026-08-03

Microsoft otevírá Orchard: skleník pro trénink agentů, ne další orchestrátor

Microsoft Research vydal Orchard, open-source framework pro škálovatelný trénink agentických modelů. Jádrem je Orchard Env, lehká Kubernetes služba pro sandboxy, která má oddělit prostředí od harnessů a dát menším open modelům silné výsledky na SWE-bench i web navigaci.

Číst

Novinky · 2026-08-01

OpenAI za dva tisíce dolarů vyřešilo dekádu staré matematické problémy

Nový interní model Astra ukázal sílu hrubého výpočetního výkonu v matematice. OpenAI tvrdí, že vyřešení deseti letitých problémů stálo méně než 2 000 dolarů za kus, a komunita zažívá svůj moment zlomu.

Číst

Novinky · 2026-07-21

Podcast Last Week in AI ukazuje týden, kdy modely, politika a energie narazily najednou

LWiAI Podcast #252 skládá GPT-5.6, Grok 4.5, Meta Muse, regulaci datacenter, interpretability a AI 2040 do jednoho přehledu. Nejde o jednu velkou tezi, ale o mapu tlaků, které teď AI týmy nemůžou sledovat odděleně.

Číst

Novinky · 2026-07-22

Google testuje SymptomAI na 13 917 lidech, ale diagnóza to zatím není

Google Research představil SymptomAI, studii konverzačních agentů pro rozhovor o symptomech a diferenciální diagnostiku na 13 917 účastnících. Výsledky jsou výzkumné, ne klinické: generované diagnózy podle Googlu nebyly potvrzené lékařské posudky.

Číst

Novinky · 2026-07-31

Lokalní eval framework ukazuje, že prompt inženýrství přechází k vývojářským návykům

Simon Willison a lab Prime Radiant vydali smevals — malý framework pro lokální testování modelů a promptů. Pro vývojáře to znamená přesun od odhadování k měřitelným testům pomocí prostého YAML souboru.

Číst

Novinky · 2026-07-30

Gemini Robotics ER 2 mění roboty z vykonavatelů na hlídače vlastních chyb

Google představil model Gemini Robotics ER 2, který integruje porozumění videu a orchestraci více robotů. Cílem je, aby stroje samy dokázaly vyhodnotit průběh fyzického úkolu a reagovaly na neočekávané změny.

Číst

Novinky · 2026-07-28

Claude Mythos za 60 hodin prořízl kandidáta post-kvantového podpisu HAWK

Anthropic ukázal, že Claude Mythos Preview našel matematickou slabinu v post-kvantovém kandidátu HAWK a zlepšil útok na okleštěný AES. Oba výsledky prý nic neruší v produkci, ale mění, kdo může dělat cryptanalysis v týdenním cyklu.

Číst

Novinky · 2026-07-27

Amodei odmítá zákaz open weights. Chce čipy, distillation a povinné testy

Dario Amodei napsal, že Anthropic nikdy neprosazoval zákaz open-weights modelů. Místo plošného banu tlačí exportní kontrolu čipů, zásah proti průmyslové distillation a povinné safety testy pro dost silné open i closed systémy.

Číst

Novinky · 2026-07-27

Anthropic tlačí Claude do enterprise přes armádu od Cognizantu

Cognizant nasazuje modely Claude do svých vlastních nástrojů a školí na ně třicet tisíc konzultantů. Anthropic tak získává to, co laboratoř sama postavit nedokáže: integrátora s certifikátem pro korporátní klienty.

Číst

Novinky · 2026-07-27

Průvodce AI už není o chatu. Jde o to, komu svěříte počítač

Ethan Mollick v letní edici průvodce radí pro reálnou práci Claude nebo ChatGPT od 20 dolarů měsíčně a dát agentovi počítač. Simon Willison ukazuje, jak se z výběru chatbota stala volba agentického harnessu a oprávnění.

Číst

Novinky · 2026-07-27

Po průniku na Hugging Face skládá NVIDIA alianci pro otevřenou AI obranu

NVIDIA s desítkami firem včetně Hugging Face, Microsoftu a Linux Foundation zakládá Open Secure AI Alliance. Oficiální argument opírá o červencový incident, kdy uzavřené API brzdilo forenzní práci a lokální open-weight model pomohl projít víc než 17 000 akcí.

Číst

Novinky · 2026-07-21

Gemini 3.6 Flash šetří 17 % výstupních tokenů, Cyber zůstává za závorou

Google vydal Gemini 3.6 Flash a 3.5 Flash-Lite pro vývojáře, firmy i aplikaci Gemini. Specializovaný 3.5 Flash Cyber ale dostanou jen vlády a důvěryhodní partneři v omezeném pilotu, takže jedna modelová řada nabízí dva úplně odlišné režimy distribuce.

Číst

Novinky · 2026-07-24

Meta AI vstupuje do kalendáře a přebírá opakované úkoly

Meta přidává denní přehledy z kalendáře, plánování událostí, průzkum webu a opakované úkoly do Meta AI na vybraných trzích. Přechod k produktivitě zvýší užitek chatbota, ale také citlivost dat a cenu každé chyby.

Číst

Novinky · 2026-07-21

Gemini 3.6 Flash tlačí cenu agentů dolů, Pro pořád čeká za oponou

Google vydal Gemini 3.6 Flash, 3.5 Flash-Lite a 3.5 Flash Cyber s důrazem na levnější agentické workflow. Pro týmy, které platí za tokeny a latenci, je důležitější ekonomika provozu než samotné pořadové číslo modelu.

Číst

Novinky · 2026-07-17

Databricks má valuaci 188 miliard dolarů a prodává AI příběh nad datovou vrstvou

Databricks oznámil nové financování při valuaci 188 miliard dolarů, jen pět měsíců po kole na 134 miliardách. Nejde pouze o fundraising: firma ukazuje, jak se enterprise data platforma přebarví na AI infrastrukturu, když má zákaznická data, governance a příběh o levnějších open-weight modelech.

Číst

Novinky · 2026-07-16

DeepMind spojuje biosecurity s vlastním AI stackem

Google DeepMind a Isomorphic Labs představily společný přístup k bioresilience: prevence zneužití modelů, rychlejší detekce ohnisek a podpora reakce na nové hrozby. Důležité je číslo přes 15 partnerství za 12 měsíců, ale i otázka, kdo bude těmto modelům smět důvěřovat.

Číst

Z Knihovny