Lilith Lilith.
CS EN PL

Z Novinek

Novinky · 2026-08-10

Lambert vydává knihu o ladění modelů, která ukazuje praxi za open-source AI

Nathan Lambert z výzkumné komunity kolem otevřených modelů oznámil vydání knihy o post-training fázích. Slibuje pohled do reálných lekcí z trénování, což může pro inženýrské týmy znamenat posun od akademické teorie k praktickým návodům pro fine-tuning.

Číst

Novinky · 2026-07-17

NeMo Automodel bere Diffusers z notebooku do clusteru

NVIDIA a Hugging Face ukazují integraci NeMo Automodel s Diffusers pro fine-tuning obrazových a video diffusion modelů ve velkém měřítku. Praktická pointa je prostá: méně převodů checkpointů, víc škálování a jasnější cesta od Hub modelu k tréninku.

Číst

Novinky · 2026-07-23

Nunchaku v Diffusers snižuje paměť pro image modely na 12 GB

Hugging Face přidal podporu Nunchaku 4-bit diffusion inference do Diffusers: 1024x1024 obraz na RTX 5090 má podle blogu běžet kolem 1,7 sekundy a 12 GB paměti místo 24 GB v BF16. Praktická pointa je menší tření mezi research kódem a běžným Python workflow.

Číst

Novinky · 2026-07-27

Amodei odmítá zákaz open weights. Chce čipy, distillation a povinné testy

Dario Amodei napsal, že Anthropic nikdy neprosazoval zákaz open-weights modelů. Místo plošného banu tlačí exportní kontrolu čipů, zásah proti průmyslové distillation a povinné safety testy pro dost silné open i closed systémy.

Číst

Novinky · 2026-07-22

Otevřené modely už nejsou charita, ale geopolitická strategie

Interconnects spojil Kimi K3, Qwen 3.8, GLM 5.2 a projev Si Ťin-pchinga ve WAIC do jedné mapy otevřených modelů. Důležité je, že open weights se z technické volby posouvají do průmyslové a politické páky.

Číst

Novinky · 2026-07-15

Shippy ukazuje, že agent pro ostrý provoz začíná u hranic a auditů

Ai2 popisuje Shippy, maritime AI agenta pro Skylight, který pracuje s živými satelitními a lodními signály ve více než 70 zemích. Nejcennější lekce leží v izolaci, deterministických nástrojích a evals nad celým agentem.

Číst

Novinky · 2026-07-02

Nemotron 3.5 mění content safety z filtru na policy engine

NVIDIA vydala na Hugging Face Nemotron 3.5 Content Safety, 4B multimodální model pro safety verdikty s custom policy, reasoning traces a podporou mnoha jazyků.

Číst

Novinky · 2026-07-02

Cohere posílá 30B coding model do agentických harnessů

Cohere vydává North Mini Code, 30B Mixture of Experts model s 3B aktivními parametry pod licencí Apache 2.0. Zajímavější než benchmarkový žebříček je důraz na robustness across harnesses, protože coding agent selhává často na rozhraní, ne jen na samotném kódu.

Číst

Novinky · 2026-06-15

Odchod Nathan Lambert z Ai2 ukazuje slabé místo open modelů

Nathan Lambert oznámil odchod z Allen Institute for AI a využil ho jako bilanci práce na Olmo. Nejde jen o personální zprávu, ale o připomínku, že open modely stojí na institucích, které musejí vydržet déle než jeden silný tým.

Číst

Novinky · 2026-06-15

Holo3.1 tlačí computer-use agenty z cloudu na lokální stroje

H Company vydala Holo3.1, rodinu computer-use modelů pro web, desktop, mobile a lokální inference. Nejdůležitější není jen vyšší skóre, ale snaha dostat agenta blíž k místu, kde se práce skutečně děje.

Číst

Novinky · 2026-06-15

Malé modely ukazují, že agentní hra stojí na nudné infrastruktuře

Hugging Face publikoval field report z Build Small Hackathonu o simulaci Thousand Token Wood v2, kde čtyři postavy běží na čtyřech různých malých modelech. Klíčová lekce pro agentní systémy: serving, JSON opravy, firewall tajných informací a omezená paměť rozhodují víc než poetický prompt.

Číst

Novinky · 2026-06-14

DOX dává agentům lokální kontext přes AGENTS.md

Agent Zero vydal DOX, minimalistický framework pro hierarchii AGENTS.md souborů. Neřeší nový runtime, ale disciplínu: agent má před změnou přečíst lokální pravidla a po větší úpravě je udržet aktuální.

Číst

Novinky · 2026-06-09

Voice agents se lámou na bilingvních hovorech dřív než na modelových demech

ServiceNow AI zveřejnil benchmark ASR pro code-switched speech v enterprise scénářích a testoval sedm systémů. Pointa je nepříjemná: u voice agents se chyba v přepisu propisuje do celého workflow, takže bilingualita není okrajový UX detail.

Číst

Novinky · 2026-06-09

Claude Fable 5 mění safety v otázku přístupu k nejlepším modelům

Nathan Lambert čte vydání Claude Fable 5 jako spor o to, kdo smí používat frontier model bez přesměrování a filtrů. Klíčová je governance vrstva, která rozhoduje, kdy uživatel skutečně mluví s tím nejlepším systémem.

Číst

Novinky · 2026-06-03

Reachy Mini dostal MCP nástroje z Hugging Face Spaces

Hugging Face ukazuje, jak může Reachy Mini volat MCP tools běžící ve veřejných Spaces. Podstatný posun je oddělení robotického těla od schopností, které se dají sdílet a aktualizovat mimo aplikaci.

Číst

Novinky · 2026-05-26

Interconnects kreslí mapu další fáze modelové konkurence

Nathan Lambert v květnovém přehledu píše o Gemini Flash 3.5, Mythos, agentních nástrojích a napětí mezi open a closed modely.

Číst

Novinky · 2026-06-01

NVIDIA Cosmos 3 tlačí physical AI do jednoho modelu

NVIDIA vydala Cosmos 3 na Hugging Face jako open omni-model pro world generation, physical reasoning a action generation.

Číst

Novinky · 2026-06-01

Otevřené modely dohánějí cenu, frontier zůstává placená disciplína

Nathan Lambert tvrdí, že open a closed modely se budou zlepšovat po různých křivkách. Praktická otázka není ideologie open source, ale kde se firmám vyplatí platit prémii za nejlepší model.

Číst

Novinky · 2026-05-11

CodexBar sjednocuje přehled limitů 29 AI coding nástrojů v jedné ikoně

CodexBar je open-source macOS menu-bar aplikace, která sjednocuje přehled limitů, kreditů, resetů a incidentů napříč AI coding providery. Podle oficiálního webu míří na 29 služeb včetně Codexu, Claude, Cursoru, Gemini, Copilotu, OpenRouteru nebo Kiro.

Číst

Novinky · 2026-04-15

VAKRA benchmark odhaluje, kde agenti skutečně selhávají: výběr nástrojů, argumenty, vícekrokové plánování

IBM Research vydal VAKRA: benchmark pro agenty s 8000+ reálnými API přes 62 domén. Testuje celé exekuční trajektorie, nejen finální odpovědi. Výsledky ukazují, kde se systémy lámou: výběr nástroje, specifikace argumentů a vícezdrojové dotazy s policy omezeními.

Číst

Z Knihovny