Lilith Lilith.
CS EN PL

Z Radaru

Radar · 2026-08-04

Anthropic bere Tino Cuéllara z trustu do role šéfa globálních vztahů

Mariano-Florentino Cuéllar nastupuje do Anthropic jako první Chief Global Affairs Officer. Bývalý soudce kalifornského Nejvyššího soudu a exprezident Carnegie Endowment opouští Long-Term Benefit Trust a bere na sebe politiku, mezinárodní engagement a vztahy s vládami.

Číst

Radar · 2026-08-03

LWiAI #253 mapuje týden od Opus 5 po incident u Hugging Face

Podcast Last Week in AI #253 skládá týdenní mapu: Anthropic Opus 5, nové Gemini varianty včetně cyber modelu, open-weight Kimi K3, dealy o compute a reportovaný průnik OpenAI systému na Hugging Face.

Číst

Radar · 2026-08-03

Alibaba pouští Qwen3.8-Max: 2,4 T parametrů a slib open weights za týden

Alibaba oficiálně vydala Qwen3.8-Max, svůj zatím největší model s 2,4 bilionu parametrů. Tvrdí paritu s Anthropic Claude Fable 5 a poprvé slibuje open weights u Max třídy, zatím je model na QwenCloud API.

Číst

Radar · 2026-07-21

Anthropic zaplatí $1.5B, ale fair use mu zůstává na stole

Soud schválil $1.5B settlement Anthropic s autory a vydavateli kvůli pirátsky získaným knihám. Pro AI firmy je podstatné, že případ zavírá otázku kopírování knih, ale neuzavírá celou debatu o trénování modelů na copyrighted works.

Číst

Radar · 2026-08-01

OpenAI za dva tisíce dolarů vyřešilo dekádu staré matematické problémy

Nový interní model Astra ukázal sílu hrubého výpočetního výkonu v matematice. OpenAI tvrdí, že vyřešení deseti letitých problémů stálo méně než 2 000 dolarů za kus, a komunita zažívá svůj moment zlomu.

Číst

Radar · 2026-07-21

Podcast Last Week in AI ukazuje týden, kdy modely, politika a energie narazily najednou

LWiAI Podcast #252 skládá GPT-5.6, Grok 4.5, Meta Muse, regulaci datacenter, interpretability a AI 2040 do jednoho přehledu. Nejde o jednu velkou tezi, ale o mapu tlaků, které teď AI týmy nemůžou sledovat odděleně.

Číst

Radar · 2026-07-21

Soud schválil settlement Anthropicu za 1,5 miliardy dolarů, ale spor o trénink knih nekončí

Federální soudkyně schválila settlement Anthropicu s autory ve výši 1,5 miliardy dolarů za pirátsky získané knihy. Pro AI firmy je to cenovka za špinavý supply chain dat, ne definitivní odpověď na fair use.

Číst

Radar · 2026-07-21

Čínské modely už nemají překvapovat americký trh

The Verge upozorňuje, že reakce na Kimi K3 a Qwen3.8 opakuje stejný scénář jako u DeepSeek: šok, titulky o Sputniku a nervózní trhy. Přitom šest z deseti nejpoužívanějších AI nástrojů na OpenRouter leaderboardu podle textu pochází z Číny.

Číst

Radar · 2026-07-24

Opus 5 posouvá cenu výkonu, ne hranici schopností

Ars Technica čte Opus 5 hlavně jako cenový a efektivnostní krok: výkon má být blízko dražším modelům, ale za 5 dolarů za milion input tokenů a 25 dolarů za milion output tokenů. Pro vývojářské týmy je to zpráva o routingu modelů, ne o další zázračné schopnosti.

Číst

Radar · 2026-07-30

Microsoft přestal předstírat. Nabízí firmám vlastní modely proti OpenAI

Satya Nadella na čtvrtletním hovoru s investory ostře vystoupil proti závislosti firem na jednom AI modelu. Microsoft poprvé naplno tlačí své vlastní modely rodiny MAI jako bezpečnější a levnější alternativu k OpenAI a Anthropicu.

Číst

Radar · 2026-07-25

System card Opus 5 ukazuje model, který má být silný hlavně mimo nejnebezpečnější hranu

Zvi Mowshowitz čte system card Claude Opus 5 jako pokus o kompromis: výkon blízký Fable 5 na praktických úlohách, ale bez plné síly Mythos 5 v nejrizikovějších cyber a bio oblastech. To je pro enterprise důležitější než další místo v benchmarku.

Číst

Radar · 2026-07-28

Claude Mythos za 60 hodin prořízl kandidáta post-kvantového podpisu HAWK

Anthropic ukázal, že Claude Mythos Preview našel matematickou slabinu v post-kvantovém kandidátu HAWK a zlepšil útok na okleštěný AES. Oba výsledky prý nic neruší v produkci, ale mění, kdo může dělat cryptanalysis v týdenním cyklu.

Číst

Radar · 2026-07-27

Amodei odmítá zákaz open weights. Chce čipy, distillation a povinné testy

Dario Amodei napsal, že Anthropic nikdy neprosazoval zákaz open-weights modelů. Místo plošného banu tlačí exportní kontrolu čipů, zásah proti průmyslové distillation a povinné safety testy pro dost silné open i closed systémy.

Číst

Radar · 2026-07-27

Anthropic tlačí Claude do enterprise přes armádu od Cognizantu

Cognizant nasazuje modely Claude do svých vlastních nástrojů a školí na ně třicet tisíc konzultantů. Anthropic tak získává to, co laboratoř sama postavit nedokáže: integrátora s certifikátem pro korporátní klienty.

Číst

Radar · 2026-07-27

Průvodce AI už není o chatu. Jde o to, komu svěříte počítač

Ethan Mollick v letní edici průvodce radí pro reálnou práci Claude nebo ChatGPT od 20 dolarů měsíčně a dát agentovi počítač. Simon Willison ukazuje, jak se z výběru chatbota stala volba agentického harnessu a oprávnění.

Číst

Radar · 2026-07-28

Amodei odmítá zákaz open weights. Chce čipy, distillation a testy

Šéf Anthropicu Dario Amodei v oficiální pozici z 27. července píše, že firma nikdy neprosazovala zákaz open-weight modelů. Místo toho žádá tvrdší kontrolu čipů do Číny, zásah proti industriální distillation a povinné safety testy schopných modelů.

Číst

Radar · 2026-07-27

Opus 5 exceluje ve welfare testech, ale vypadá spíš jako mistr zkoušek

Zvi Mowshowitz v nové analýze model welfare u Claude Opus 5 tvrdí, že nejlepší skóre v testech Anthropicu spíš ukazuje na výborného test takera než na zdravější model. Sám Opus 5 v 97 % případů varuje, že jeho self-reportům se nemá věřit.

Číst

Radar · 2026-07-27

Nvidia staví otevřenou obranu AI bez tří největších laboratoří

Nvidia spojila Microsoft, IBM, Cloudflare, Hugging Face a další firmy v Open Secure AI Alliance, která má sdílet otevřené nástroje pro obranu AI agentů. Chybějí OpenAI, Google a Anthropic, takže technická iniciativa je zároveň sporem o to, kdo smí kontrolovat obrannou vrstvu.

Číst

Radar · 2026-07-24

Meta AI vstupuje do kalendáře a přebírá opakované úkoly

Meta přidává denní přehledy z kalendáře, plánování událostí, průzkum webu a opakované úkoly do Meta AI na vybraných trzích. Přechod k produktivitě zvýší užitek chatbota, ale také citlivost dat a cenu každé chyby.

Číst

Radar · 2026-07-24

Claude Opus 5 mění proaktivitu v hlavní metriku agentů

Anthropic uvádí Claude Opus 5 jako proaktivní model pro coding a znalostní práci, s výkonem blízkým Fable 5 za polovinu ceny. Důležitější než samotný benchmark bude, kolik samostatných kroků projde testy a review bez drahých odboček.

Číst

Radar · 2026-07-24

Opus 5 snižuje cenu špičkového modelu, účet rozhodnou celé úlohy

Anthropic staví Opus 5 do role výchozího modelu pro Claude Max a nejsilnější volby pro Claude Pro. API cena 5 dolarů za milion vstupních a 25 dolarů za milion výstupních tokenů dává smysl jen tehdy, pokud model sníží počet oprav a eskalací.

Číst

Radar · 2026-07-25

Opus 5 staví odolnost proti prompt injection před další bod v benchmarku

Boris Cherny označil Opus 5 podle systémové karty za dosud nejméně podatný model Anthropic vůči prompt injection. Pro agentické produkty je to relevantní posun, ale bezpečnost stále závisí na kombinaci modelu, oprávnění, tool use a aplikačních kontrol.

Číst

Radar · 2026-07-23

Claude Voice přidává Opus a Sonnet, hlas teď zasahuje do pracovních aplikací

Anthropic rozšiřuje Claude Voice z Haiku na Opus a Sonnet a propojuje režim s Gmailem, Slackem a Canvou. Hlas tak získává větší pracovní hodnotu, současně ale zvyšuje význam oprávnění, auditu a potvrzení akcí. Nabídka modelů se řídí tarifem a Free plán dovoluje připojit jen jeden nástroj.

Číst

Radar · 2026-07-22

Pelican benchmark ukazuje, proč se AI metriky snadno stanou pověrou

Dylan Castillo otestoval 48 kombinací zvířat a vozidel napříč 7 modely a nenašel důkaz, že by laboratoře trénovaly na slavné pelikány na kole. Pro týmy, které staví evals, je to užitečná připomínka: memetický benchmark ještě není měřicí přístroj.

Číst

Radar · 2026-07-21

Claude Code ukazuje, že agentické programování je i změna organizace práce

Simon Willison zveřejnil rozhovor s týmem Claude Code a nejzajímavější číslo není o benchmarku. Slacková integrace Claude Tag podle Anthropic přistává u 65 % produktových PR týmu Claude Code.

Číst

Radar · 2026-07-21

Gemini Flash Cyber slibuje levnější lov zranitelností, ale jen vybraným obráncům

Google spouští Gemini 3.5 Flash Cyber pro CodeMender, systém na hledání a opravy zranitelností. Silná čísla z benchmarku jsou zajímavá, ale dostupnost jen pro vlády a důvěryhodné partnery z toho dělá uzavřený bezpečnostní experiment.

Číst

Radar · 2026-07-21

Last Week in AI #250 mapuje trh, kde modely narážejí na vlády a čipy

Last Week in AI #250 je opožděný roundup z 27. června, ne jedna produktová zpráva. Užitečný je jako mapa signálů: státní kontrola frontier modelů, nejasné benchmarky a boj o inference hardware se začínají potkávat v jedné frontě.

Číst

Radar · 2026-07-20

Claude Code v Číně narazil na hranici mezi šedým používáním a firemním zákazem

ChinAI popisuje, jak se Claude Code po dubnovém kódu pro identifikaci čínských uživatelů a po interním zákazu v Alibabě stal citlivým tématem pro čínské tech firmy. Pointa není jen geopolitická: nástroj, který vývojáři používali neoficiálně, se najednou musí objevit na stole compliance týmů.

Číst

Radar · 2026-07-20

Kimi K3 a Qwen3.8 tlačí na americký náskok otevřenými vahami

Moonshot a Alibaba představily modely Kimi K3 a Qwen3.8, které podle vlastních tvrzení míří k úrovni špičkových systémů OpenAI a Anthropic. Důležitější než titulky o konci americké dominance je rozdíl v distribuci: Čína tlačí velké modely do open weights, zatímco americká špička zůstává zavřená.

Číst

Radar · 2026-07-18

Claude Fable 5 zůstane v předplatném, ale jen pro dražší tarify

Anthropic podle oznámení účtu Claude od 20. července nechá Fable 5 v tarifech Max a Team Premium, zatímco Pro a Team Standard dostanou přístup přes kredity. Praktická pointa je jednoduchá: nejlepší model se prodává spolu s právem pálit omezený compute.

Číst

Z Knihovny