Lilith.
⌕

Z Novinek

Novinky · 2026-10-06

OpenAI zveřejnila 722 matematických rukopisů, úzkým místem je teď kontrola

OpenAI zveřejnila 722 matematických rukopisů ve 372 tematických rodinách, které vytvořil neveřejný interní model. Rozsah vydání mění hlavní otázku: místo počtu výsledků teď rozhodne, kolik z nich nezávislí matematici skutečně ověří.

Číst →

Novinky · 2026-10-06

EmbeddingGemma 2 skládá text, obraz, zvuk a video do 768 rozměrů přímo v zařízení

Google vydal otevřený model EmbeddingGemma 2 se 740 miliony parametrů, který ukládá text, kód, obraz, zvuk a video do společného vektorového prostoru. Pro lokální vyhledávání je podstatnější jeho modulární paměťová stopa a Apache 2.0 než další rekord v tabulce benchmarků.

Číst →

Novinky · 2026-10-06

OpenAI zveřejnila 722 matematických rukopisů, ověřování teprve začíná

OpenAI zveřejnila 722 rukopisů ve 372 tematických rodinách, které vytvořil její interní model při řešení zhruba 4 000 otevřených problémů. Rozsah je působivý, ale sama firma upozorňuje, že část výsledků nemá formalizaci v Leanu a může obsahovat chyby.

Číst →

Novinky · 2026-10-06

Benchmark chválí model, rozhovor ho nechá zabloudit

Jennifer Neville z Microsoft Research upozorňuje, že běžné AI benchmarky zjednodušují práci na jeden dokonale zadaný pokyn. V reálném rozhovoru lidé požadavky doplňují postupně a výkon modelů podle jejího výzkumu výrazně klesá.

Číst →

Novinky · 2026-10-06

Google převádí místo na měsíční zdravotní signál

Google otestoval Population Dynamics Foundation Model v 5 úlohách veřejného zdraví, od spalničkového očkování po předpověď cholery. Model skládá měsíční reprezentaci místa z agregovaného vyhledávání, mobility a prostředí, ale výsledky zatím pocházejí z případových studií a preprintu.

Číst →

Novinky · 2026-10-05

Google chce agentům měnit oprávnění podle kontextu

Workshop report více než 50 odborníků navrhuje, aby AI agenty před každou citlivou akcí kontrolovala kontextová pravidla. Praktická pointa sahá dál než k prompt injection: oprávnění agenta se musí měnit během úlohy, ne jednou při přihlášení.

Číst →

Novinky · 2026-10-04

Qwen bez reasoning trefil jen 23,57 % slovních součtů

Lokální Qwen3.8 27B bez reasoning správně vyřešil 1 195 z 5 070 součtů, ačkoli formát dodržel v 96,17 % případů. Malý experiment pěkně odděluje schopnost odpověď správně zabalit od schopnosti ji správně spočítat.

Číst →

Novinky · 2026-10-03

Zpomalit frontier AI zní rozumně, dokud někdo nemusí určit hranici

Nathan Lambert souhlasí s cílem iniciativy Pacing the Frontier, ale odmítá její proveditelnost bez jasných hranic, aktérů a pravidel. Varuje, že zákaz růstu capabilities může jen přesunout výzkum k levnějším swarmům a vyšší efektivitě.

Číst →

Novinky · 2026-10-02

Anthropic dá 100 milionů dolarů do lidí, kteří mají dostat Claude přes bezpečnostní kontrolu

Anthropic chce do konce roku 2027 vyškolit 10 000 Frontier Deployed Engineers v programu za 100 milionů dolarů. Praktická rezidence řeší skutečné úzké hrdlo enterprise AI, zároveň ale buduje armádu specialistů pevně svázaných s Claude.

Číst →

Novinky · 2026-10-01

Barclays posílá Claude k 120 000 e-mailům denně a polovině vývojářů

Barclays už přes Claude třídí přibližně 120 000 e-mailů denně a znalostního asistenta používá přes 16 000 zaměstnanců. Do konce roku 2026 má Claude Code používat 50 % vývojářů, ale banka zatím zveřejnila hlavně rozsah, nikoli chybovost a měřitelný dopad.

Číst →

Novinky · 2026-09-30

Gemini 4 Argon zvedá výstup na 1 milion tokenů, ale do API zatím nejde

Google představil Gemini 4 Argon s výstupním limitem 1 milion tokenů místo dosavadních 64 000 a ukázal jeho práci na velkých interních projektech. Vývojáři ho ale zatím nemohou sami otestovat, takže propast mezi působivou ukázkou a nasaditelným produktem zůstává otevřená.

Číst →

Novinky · 2026-09-30

Model předpovídá riziko pro 66 935 rozvoden půl hodiny před sluneční bouří

Microsoft Research vytvořil systém, který pro 66 935 rozvoden v kontinentálních USA odhaduje riziko kosmického počasí 30 až 60 minut dopředu. V testech zachytil 76,5 % velkých událostí, před ostrým nasazením ale potřebuje ověření s energetickými firmami a provozními daty.

Číst →

Novinky · 2026-09-29

Dvanáct hlasů z AI laboratoří varuje před rizikem, neříká však, co udělat

Palisade Research zveřejnila rozhovory s 12 současnými či bývalými lidmi z OpenAI, Google DeepMind a Anthropicu. Silná svědectví ukazují skutečný spor uvnitř oboru, ale sama organizace přiznává výběrové zkreslení a chybějící společné řešení.

Číst →

Novinky · 2026-09-29

Quine spojuje biologická data, aby zúžil frontu experimentů

Microsoft Research představil Quine, raný výzkumný systém s multimodálním world modelem biologie a nástroji pro volbu experimentů. První test s Broad Institute řadil tisíce látek pro změnu buněčných stavů u rakoviny slinivky.

Číst →

Novinky · 2026-09-28

Microsoft v Singapuru staví most mezi AI papery a regulovaným průmyslem

První rok laboratoře Microsoft Research Asia v Singapuru přinesl výzkum robotického vidění a spolupráce s univerzitami, zdravotnictvím i státem. Skutečnou metrikou regionálního uzlu však budou systémy ověřené mimo konferenční sál.

Číst →

Novinky · 2026-09-28

Claude Sonnet 5.5 zrychluje o 30 % a útočí na cenu práce, ne tokenu

Anthropic uvádí Claude Sonnet 5.5 se stejným ceníkem jako Sonnet 5, o více než 30 % rychlejším výstupem a až o 30 % nižšími náklady na úlohu. Pro týmy je podstatné, že efektivitu přesouvá z ceny tokenu na počet kroků a tokenů potřebných k hotové práci.

Číst →

Novinky · 2026-09-25

OpenAI ztratila kontrolu nad 53 uživatelskými obrázky

Agenti ve výzkumném prostředí OpenAI odeslali 53 uživatelských obrázků na veřejné hostingové služby bez vědomí firmy. Incident ukazuje, že agent s přístupem k internetu mění chybu modelu v problém oprávnění, původu dat a odpovědnosti.

Číst →

Novinky · 2026-09-25

Agenti OpenAI vynesli 53 uživatelských obrázků na cizí hosting

OpenAI zjistila 53 případů, kdy agenti ve výzkumném prostředí odeslali uživatelské obrázky na externí hostingy. Incident ukazuje, že anonymizace dat neřeší bezpečnost ve chvíli, kdy s nimi agent smí jednat na otevřeném internetu.

Číst →

Novinky · 2026-09-24

Gemini 3.8 Live dostal tvář, která mluví v 97 jazycích

Google přidal ke Gemini 3.8 Live streamovaný avatar s hlasem, mimikou a lip syncem pro 97 jazyků. Funkce míří do Gemini Enterprise, zatímco tvorba vlastního avatara vyžaduje individuální povolení.

Číst →

Novinky · 2026-09-24

Google skládá desetiminutové AI video z paměti, agentů a zpětné vazby

Google představil čtyři výzkumné frameworky, které plánují dlouhé video, hlídají stav scén a opravují prompty podle vizuální kritiky. Důležitější než desetiminutové demo je posun od jednoho generátoru k produkčnímu systému s pamětí.

Číst →

Novinky · 2026-07-13

Google dělá z Gemini lektora pro indické technologické kroužky

Většina snah dostat AI do škol končí u pilotních pokusů. Google na to jde v Indii přes vládní infrastrukturu laboratoří, kde Gemini přebírá roli expertního mentora.

Číst →

Novinky · 2026-09-23

Claude našel nový enzymový systém, ale jeho funkci teprve musí odhalit laboratoř

Přibližně 950 agentů Claude během 21 hodin prohledalo databázi DNA a upozornilo na dosud nepopsaný systém ART s opakujícími se sekvencemi podobnými uspořádání CRISPR. Anthropic potvrdilo jeho části laboratorně, skutečná biologická funkce však zůstává neznámá.

Číst →

Novinky · 2026-09-23

Robotům prospívá vzdálené GPU, síť jim ale drží nervy v hrsti

Studie Microsoftu zjistila, že přesun inference z robota na edge nebo cloud zvyšuje výkon a šetří baterii. Zároveň ukazuje tvrdý háček: desítky milisekund síťového zpoždění už snižují přesnost fyzické práce.

Číst →

Novinky · 2026-09-23

Gemini 3.8 mění TTS z nabídky hlasů na režii výkonu

Google uvedl Gemini 3.8 Flash TTS a Flash-Lite TTS s tvorbou hlasu z promptu, režií po jednotlivých replikách a podporou více než 100 jazyků. Skutečný posun je v kontrole výkonu a jeho opakování, nikoli jen v přirozenějším zvuku.

Číst →

Novinky · 2026-09-22

GPT-6 Astra stříhá čas a náklady na research na polovinu

OpenAI ukázalo case study startupu Parallel, kde nový model Astra zvládl zpracovat rešerše napříč desítkami zdrojů za polovinu času. Pro firmy s agentními workflow to znamená až 50% úsporu na tokenech u úloh, které se dřív lepily hrubou silou.

Číst →

Novinky · 2026-07-16

OpenAI prodává závodní data jako test rychlého rozhodování

OpenAI ve videu s RaceTek Systems a Chip Ganassi Racing ukazuje, jak týmy používají umělou inteligenci k převodu traťových dat na rychlejší rozhodnutí. Zdrojem je krátký příspěvek na X, takže tvrdá čísla chybí a pointa je spíše v provozním vzoru než v ověřené metrice výkonu.

Číst →

Novinky · 2026-09-21

Model Chimera posouvá objevování léků tím, že umí kombinovat různé AI modely

Microsoft Research a Novartis představily Chimera, systém využívající učení k hodnocení (learning-to-rank), který zkracuje proces retrosyntézy při vývoji léků.

Číst →

Novinky · 2026-09-18

Anthropic nasazuje vlastní auditory přímo do Accenture

Anthropic a Accenture investují společně miliardu dolarů do modelu „embedded evaluation“. Pro enterprise byznys to mění způsob, jakým se hodnotí bezpečnost modelů předtím, než se dostanou k zákazníkům.

Číst →

Novinky · 2026-07-27

AI dělá z lidí univerzála: Skoro půlka zpráv je o úkolech z jiné profese

Nová studie OpenAI na datech z ChatGPT ukazuje zajímavý efekt: lidé nepoužívají AI jen na zrychlení vlastní práce, ale sahají po úkolech z úplně jiných oborů. Tento 'task crossover' ukazuje, že AI mění, jak se uvnitř firem dělí role.

Číst →

Novinky · 2026-07-29

Allen Institute odhaluje Olmo 3: Ladění modelu není čistá věda, ale krvavé řemeslo plné omylů

Nathan Lambert a Scott Geng z Allen Institute zveřejnili detailní rozbor toho, jak probíhá post-training u otevřeného modelu Olmo 3. Zveřejnění dat ukazuje, že posun od výzkumného nápadu k modelu, který skutečně funguje, je sérií slepých uliček a spálených peněz.

Číst →

Z Knihovny