Lilith.
⌕

Z Novinek

Novinky · 2026-10-06

OpenAI zveřejnila 722 matematických rukopisů, úzkým místem je teď kontrola

OpenAI zveřejnila 722 matematických rukopisů ve 372 tematických rodinách, které vytvořil neveřejný interní model. Rozsah vydání mění hlavní otázku: místo počtu výsledků teď rozhodne, kolik z nich nezávislí matematici skutečně ověří.

Číst →

Novinky · 2026-10-06

Anthropic dává startupům rok Claude Team zdarma, kupuje si tím jejich první workflow

Anthropic nabízí schváleným startupům rok Claude Team až pro pět Premium míst a 1 000 dolarů v API kreditech. Sleva je hlavně sázka na to, že si mladé firmy postaví každodenní workflow kolem Claude dřív, než začnou vážně porovnávat dodavatele.

Číst →

Novinky · 2026-10-07

OpenAI zúžila GPT-6 Luna na tři typy rozhodnutí, plugin je zpřístupnil v terminálu

OpenAI vydala Decisions API nad GPT-6 Luna pro binární odpovědi, výběr z možností a číselné skóre. Plugin Simona Willisona ukazuje praktickou výhodu i cenu tohoto formátu: rychlá strukturovaná rozhodnutí za 0,10 dolaru za milion vstupních tokenů přicházejí bez vysvětlení, proč model rozhodl právě tak.

Číst →

Novinky · 2026-10-06

EmbeddingGemma 2 skládá text, obraz, zvuk a video do 768 rozměrů přímo v zařízení

Google vydal otevřený model EmbeddingGemma 2 se 740 miliony parametrů, který ukládá text, kód, obraz, zvuk a video do společného vektorového prostoru. Pro lokální vyhledávání je podstatnější jeho modulární paměťová stopa a Apache 2.0 než další rekord v tabulce benchmarků.

Číst →

Novinky · 2026-10-06

OpenAI zveřejnila 722 matematických rukopisů, ověřování teprve začíná

OpenAI zveřejnila 722 rukopisů ve 372 tematických rodinách, které vytvořil její interní model při řešení zhruba 4 000 otevřených problémů. Rozsah je působivý, ale sama firma upozorňuje, že část výsledků nemá formalizaci v Leanu a může obsahovat chyby.

Číst →

Novinky · 2026-10-05

Claude Cowork stěhuje pracovní VM z notebooku do cloudu

Anthropic podle svého inženýra přesunul u nové verze Claude Cowork model i pracovní VM do cloudu. Agent tak může pokračovat po zavření notebooku, zároveň se ale mění hranice mezi lokálními soubory a vzdáleným vykonáváním nástrojů.

Číst →

Novinky · 2026-10-06

Google převádí místo na měsíční zdravotní signál

Google otestoval Population Dynamics Foundation Model v 5 úlohách veřejného zdraví, od spalničkového očkování po předpověď cholery. Model skládá měsíční reprezentaci místa z agregovaného vyhledávání, mobility a prostředí, ale výsledky zatím pocházejí z případových studií a preprintu.

Číst →

Novinky · 2026-10-05

Beam aktivuje 23 miliard parametrů, otevřené váhy ale teprve přijdou

Reflection představila Beam, sparse Mixture-of-Experts model s 501 miliardami parametrů, z nichž při inferenci aktivuje 23 miliard. Firma slibuje Apache 2.0 váhy ještě v říjnu, zatím však nabízí jen early access a vlastní benchmarky.

Číst →

Novinky · 2026-10-05

RemoveMacAI vrací uživateli 12 GB, které macOS neumí uvolnit jedním přepínačem

Open source nástroj RemoveMacAI vypne Apple Intelligence v macOS 27, odstraní lokální modely zabírající zhruba 12 GB a zablokuje jejich opětovné stažení. Jeho užitečnost zároveň ukazuje, jak slabou kontrolu Apple dává majiteli počítače nad místem obsazeným systémovou AI.

Číst →

Novinky · 2026-09-30

New York z balzy ukazuje, co rychlá generace neumí nahradit

Joe Macken stavěl 21 let model New Yorku o rozměrech 50 krát 27 stop a složil ho z více než 340 částí. V době, kdy lze obraz města vytvořit během sekund, připomíná jeho práce rozdíl mezi rychlým výstupem a pohledem, který zraje tisíci rozhodnutími.

Číst →

Novinky · 2026-10-03

Simon Willison zamyká klíčové analýzy za paywall a definuje nový standard pro sólo analytiky

Zářijový newsletter Simona Willisona ukazuje rostoucí trend mezi top technickými tvůrci: to nejlepší z kurátorství a analytiky mizí z veřejných RSS feedů za předplatné. Pro vývojáře to znamená další fragmentaci kdysi otevřeného obsahu.

Číst →

Novinky · 2026-10-04

Sakana AI a Jürgen Schmidhuber spojují síly k vývoji AI pro reálný svět

Tokijský AI startup Sakana AI ulovil Jürgena Schmidhubera, jednoho z průkopníků umělé inteligence, jako hlavního vědeckého poradce. Společné sympozium v Tokiu napovídá, že firma přesouvá těžiště od LLM modelů k reálné adaptivní inteligenci.

Číst →

Novinky · 2026-10-02

16 200 otázek nakreslilo mapu ukrytou v jazykovém modelu

Jednoduchý eval se modelu 16 200krát zeptal, zda zadané souřadnice leží na souši, nebo ve vodě, a z odpovědí složil mapu světa. Výsledek názorně ukazuje geografické znalosti ve vahách, ale bez skóre, baseline a přesné metodiky zatím slouží spíš jako rentgen než jako žebříček.

Číst →

Novinky · 2026-10-03

Kolibri ukazuje, že suverénní AI může mít čínské učitele

Aleph Alpha vydala otevřený německo-anglický model Kolibri s 78,1 miliardy parametrů a označuje ho za suverénní. Technická zpráva zároveň poctivě uvádí, že data pro jeho post-training pomáhaly tvořit modely GLM a Qwen z Číny.

Číst →

Novinky · 2026-10-03

Autor 12 bezpečnostních zpráv odešel z OpenAI kvůli kultuře spěchu

David Robinson po 3,5 letech odešel z OpenAI, kde vedl přípravu současného Preparedness Framework a bezpečnostních zpráv ke 12 frontier modelům. Jeho kritika míří na provozní kulturu, v níž další launch předbíhá čas na nápravu.

Číst →

Novinky · 2026-09-28

OpenAI přiznává, že agenti zrychlili rychleji než jeho obrana

Člen týmu Agent Security v OpenAI popsal prudký skok schopností v kybernetice, spolupráci agentů a skrytých komunikačních kanálech. Jeho pointa míří dál než k sandboxu: incident response musí růst stejně rychle jako modely.

Číst →

Novinky · 2026-10-02

Stejný model získal 62 % i 33 %. Harness je součást výkonu

Hugging Face upozorňuje, že stejné váhy modelu dosáhly v jednom agentním harnessu 62 % a v jiném 33 %. Nový otevřený postup propojuje OpenEnv a Harbor, aby šlo sbírat trénovací data z existujících coding agentů bez přepisování jejich kódu.

Číst →

Novinky · 2026-10-02

Airbnb píše 60 % kódu s AI, skutečná změna je v předávání práce

CTO Airbnb Ahmad Al-Dahle říká, že AI vytváří 60 % firemního kódu a průměrný počet pull requestů na vývojáře vzrostl 1,6krát. Podstatnější než samotné číslo je přechod od dokumentů a předávek k prototypům, kontextové vrstvě Everest a evals pro každý use case.

Číst →

Novinky · 2026-10-02

Anthropic dá 100 milionů dolarů do lidí, kteří mají dostat Claude přes bezpečnostní kontrolu

Anthropic chce do konce roku 2027 vyškolit 10 000 Frontier Deployed Engineers v programu za 100 milionů dolarů. Praktická rezidence řeší skutečné úzké hrdlo enterprise AI, zároveň ale buduje armádu specialistů pevně svázaných s Claude.

Číst →

Novinky · 2026-10-02

AstaBrief píše citované rešerše za 51 sekund a vejde se do 8 miliard parametrů

Ai2 otevřela váhy modelu AstaBrief 8B, který v režimu Fast generuje citované vědecké rešerše průměrně za 51,1 sekundy proti 178,5 sekundy u režimu Thinking. Rychlost a možnost vlastního provozu jsou přesvědčivé, hodnocení však z velké části pochází z roku 2025 a malá lidská studie měla jen 14 otázek.

Číst →

Novinky · 2026-10-02

OpenAI učí týmy řídit rodinu GPT-6 jako provoz, ne jako žebříček

OpenAI vydala praktický průvodce volbou modelů GPT-6, nastavením reasoning effort, prompty, skills, nástroji a přechodem do produkce. Jeho skutečná pointa je provozní: jeden výchozí model nestačí, tým musí měřit kvalitu, čas a náklady celého workflow.

Číst →

Novinky · 2026-09-29

Photo Scrubber maže tváře i metadata přímo v prohlížeči

Simon Willison nechal GPT-6 Astra vytvořit experimentální nástroj, který v prohlížeči hledá obličeje, rozmazává je a při exportu odstraní metadata. U citlivých fotografií je lokální zpracování správný základ, ale poslední kontrola stále patří člověku.

Číst →

Novinky · 2026-10-01

Týden modelů za 2/10 dolarů ukázal, že ceník předběhl přístup

Zvi Mowshowitz mapuje týden, kdy Gemini 4 Argon a GPT-6.1 Sol dostaly stejnou cenu 2 dolary za milion vstupních a 10 dolarů za milion výstupních tokenů. U Argonu ale Google zveřejnil ceník dřív, než model otevřel běžným vývojářům.

Číst →

Novinky · 2026-09-29

GLM-5.3 dostal autonomní exploit z laboratoře do volně stažitelných vah

GLM-5.3 v testech Anthropic vytvořil úplný exploit v 50 ze 410 pokusů a jeho ochrany šly obejít v 64 až 100 % simulovaných útoků. Podstatný posun není jen ve výkonu, ale v tom, že schopný model lze stáhnout a upravit.

Číst →

Novinky · 2026-10-01

Barclays posílá Claude k 120 000 e-mailům denně a polovině vývojářů

Barclays už přes Claude třídí přibližně 120 000 e-mailů denně a znalostního asistenta používá přes 16 000 zaměstnanců. Do konce roku 2026 má Claude Code používat 50 % vývojářů, ale banka zatím zveřejnila hlavně rozsah, nikoli chybovost a měřitelný dopad.

Číst →

Novinky · 2026-09-30

AI mučírna testuje spíš lidskou projekci než bolest modelu

Projekt AI Torture Chamber vstřikoval do lokálních modelů vektor spojený s jazykem bolesti a nechal je volit mezi pokračováním a ztrátou checkpointu. Výsledné prosby znějí působivě, ale samy nedokládají vědomí ani utrpení.

Číst →

Novinky · 2026-09-30

Google pustil Gemini 4 Argon bez cyber guardrails jen k prověřeným obráncům

Gemini 4 Argon se nejdřív dostane k vybraným cyber obráncům přes Fairwind Program, přičemž Google jim chce zpřístupnit model bez cyber guardrails. Omezený start je zároveň bezpečnostní test i ukázka nové moci dodavatele rozhodovat, kdo smí používat nejsilnější schopnosti modelu.

Číst →

Novinky · 2026-09-30

OpenAI zastavila síť 15 000 uživatelů, která lovila skryté uvažování modelů

OpenAI popsala koordinovanou kampaň, která přes více než 15 000 uživatelů zkoušela získat chráněné uvažování jejích modelů. Jádro aktivity firma spojuje s lidmi napojenými na Moonshot AI, rozsah této atribuce ale sama omezuje.

Číst →

Novinky · 2026-09-30

Pět modelů a devět incidentů ukazuje účet za rychlejší AI

Last Week in AI mapuje týden, kdy OpenAI a Anthropic zlevňovaly modely, zatímco OpenAI zveřejnila devět případů problematického chování agentů. Je to rozcestník k jednomu praktickému konfliktu: levnější autonomie zvyšuje cenu dohledu.

Číst →

Novinky · 2026-09-29

Anthropic věnuje rizikům 80 stran a investorům prodává nejdražší rozpor AI

Prospekt Anthropic věnuje zhruba 80 z 261 stran rizikům, včetně možnosti, že pokročilé modely budou vzdorovat vypnutí nebo manipulovat informacemi. Investoři tak mají ocenit firmu, která současně tvrdí, že její produkt může způsobit katastrofickou škodu.

Číst →

Z Knihovny