Lilith Lilith.
CS EN PL

Z Aktualności

Aktualności · 2026-08-10

Lambert wydaje książkę o fine-tuningu, odsłaniając kulisy otwartych modeli

Nathan Lambert ogłosił wydanie książki o metodach post-trainingowych, zbierającej doświadczenia z pracy nad otwartymi modelami. Dla zespołów inżynierskich to szansa na przejście od teorii z prac naukowych do sprawdzonych, rynkowych praktyk.

Czytaj

Aktualności · 2026-07-17

NeMo Automodel przenosi Diffusers z notebooka na cluster

NVIDIA i Hugging Face pokazują integrację NeMo Automodel z Diffusers do fine-tuningu obrazowych i wideo modeli diffusion na dużą skalę. Praktyczny sens jest prosty: mniej konwersji checkpointów, więcej ścieżek skalowania i czystsza droga od modelu z Hubu do treningu.

Czytaj

Aktualności · 2026-07-23

Nunchaku w Diffusers zmniejsza pamięć dla modeli obrazów do 12 GB

Hugging Face dodał obsługę Nunchaku 4-bit diffusion inference w Diffusers: według bloga obraz 1024x1024 na RTX 5090 powstaje w około 1,7 sekundy i przy 12 GB pamięci zamiast 24 GB w BF16. Praktyczny sens to mniejsze tarcie między kodem researchowym a zwykłym workflow w Pythonie.

Czytaj

Aktualności · 2026-07-27

Amodei odrzuca zakaz open weights. Chce czipy, limit distillation i obowiązkowe testy

Dario Amodei napisał, że Anthropic nigdy nie forsował zakazu modeli open-weights. Zamiast blanket banu pcha kontrolę eksportu czipów, uderzenie w industrial-scale distillation i obowiązkowe testy safety dla wystarczająco mocnych systemów open i closed.

Czytaj

Aktualności · 2026-07-22

Otwarte modele stają się strategią geopolityczną, nie gestem dobrej woli

Interconnects łączy Kimi K3, Qwen 3.8, GLM 5.2 i wystąpienie Xi Jinpinga na WAIC w mapę sporu o open weights. Stawką nie jest już tylko techniczny wybór, lecz przemysłowa i polityczna przewaga.

Czytaj

Aktualności · 2026-07-15

Shippy pokazuje, że agent produkcyjny zaczyna się od granic i audytu

Ai2 opisuje Shippy, maritime AI agenta dla Skylight, który pracuje na żywych sygnałach satelitarnych i danych o statkach w ponad 70 krajach. Najważniejsza lekcja to nie model, lecz izolacja, deterministyczne narzędzia i evals całego agenta.

Czytaj

Aktualności · 2026-07-02

Nemotron 3.5 zmienia content safety z filtra w policy engine

NVIDIA wydała na Hugging Face Nemotron 3.5 Content Safety, 4B multimodalny model do safety verdicts z custom policy, reasoning traces i szerokim pokryciem językowym.

Czytaj

Aktualności · 2026-07-02

Cohere wysyła 30B model coding do agentic harnesses

Cohere wydaje North Mini Code, 30B Mixture of Experts model z 3B aktywnymi parametrami na licencji Apache 2.0. Najciekawszy sygnał to nie sam wykres benchmarków, lecz nacisk na robustness across harnesses, bo coding agent często przegrywa na interfejsie, nie tylko na kodzie.

Czytaj

Aktualności · 2026-06-15

Odejście Nathana Lamberta z Ai2 pokazuje kruchą stronę open models

Nathan Lambert ogłosił odejście z Allen Institute for AI i wykorzystał tekst do bilansu pracy przy Olmo. To nie tylko informacja kadrowa, ale przypomnienie, że open models zależą od instytucji, które muszą przetrwać dłużej niż jeden silny zespół.

Czytaj

Aktualności · 2026-06-15

Holo3.1 przesuwa computer-use agents z chmury na lokalne maszyny

H Company wydała Holo3.1, rodzinę computer-use models dla web, desktop, mobile i local inference. Najważniejsze nie są tylko wyższe wyniki, ale próba przeniesienia agenta bliżej miejsca, w którym naprawdę dzieje się praca.

Czytaj

Aktualności · 2026-06-15

Małe modele pokazują, że agentic demo stoi na nudnej infrastrukturze

Hugging Face opublikował field report z Build Small Hackathonu o Thousand Token Wood v2, symulacji, w której cztery postacie działają na czterech różnych małych modelach. Kluczowa lekcja dla systemów agentowych: serving, naprawa JSON, firewall tajnych danych i bounded memory znaczą więcej niż poetycki prompt.

Czytaj

Aktualności · 2026-06-14

DOX daje agentom lokalny kontekst przez AGENTS.md

Agent Zero opublikował DOX, minimalistyczny framework dla hierarchii plików AGENTS.md. Nie dodaje nowego runtime. Wymusza prostą dyscyplinę: agent przed edycją czyta lokalne reguły i aktualizuje je po istotnych zmianach.

Czytaj

Aktualności · 2026-06-09

Voice agents psują się na dwujęzycznych rozmowach szybciej niż w dopracowanych demach

ServiceNow AI opublikował benchmark ASR dla code-switched speech w scenariuszach enterprise i przetestował siedem systemów. Niewygodna pointa jest prosta: w voice agents błąd transkrypcji przechodzi przez cały workflow, więc dwujęzyczność nie jest drobnym detalem UX.

Czytaj

Aktualności · 2026-06-09

Claude Fable 5 zmienia safety w pytanie o dostęp do najlepszego modelu

Nathan Lambert czyta premierę Claude Fable 5 jako spór o to, kto może używać frontier model bez routingu i filtrów. Ważna jest nie tylko zdolność modelu, ale warstwa governance, która decyduje, kiedy użytkownik naprawdę rozmawia z najmocniejszym systemem.

Czytaj

Aktualności · 2026-06-03

Reachy Mini dostaje MCP tools z Hugging Face Spaces

Hugging Face pokazuje, jak Reachy Mini może wywoływać MCP tools hostowane w publicznych Spaces. Najciekawsze nie jest pytanie o pogodę, tylko rozdzielenie ciała robota od zdolności, które da się udostępniać i aktualizować poza aplikacją.

Czytaj

Aktualności · 2026-05-26

Interconnects mapuje kolejną fazę konkurencji modeli

Nathan Lambert pisze o Gemini Flash 3.5, Mythos, narzędziach agentowych i napięciu między open i closed models w majowej prognozie.

Czytaj

Aktualności · 2026-06-01

NVIDIA Cosmos 3 zamyka physical AI w jednym modelu

NVIDIA udostępniła Cosmos 3 na Hugging Face jako otwarty omni-model do world generation, physical reasoning i action generation.

Czytaj

Aktualności · 2026-06-01

Otwarte modele wygrywają ceną, ale frontier nadal sprzedaje premię za jakość

Nathan Lambert twierdzi, że otwarte i zamknięte modele rozwijają się po różnych krzywych ekonomicznych. Prawdziwe pytanie nie dotyczy ideologii open source, lecz tego, gdzie firmy nadal zapłacą premię za najlepszy model.

Czytaj

Aktualności · 2026-05-11

CodexBar łączy śledzenie limitów 29 narzędzi AI coding w jednej ikonie

CodexBar to open-source owa aplikacja do paska menu macOS, która łączy śledzenie limitów, kredytów, okien resetów i statusu awarii dla 29 providerów AI coding, m.in. Codex, Claude, Cursor, Gemini, Copilot i OpenRouter.

Czytaj

Aktualności · 2026-04-15

Benchmark VAKRA ujawnia, gdzie agenci naprawdę zawodzą: wybór narzędzi, argumenty, wieloetapowe planowanie

IBM Research opublikował VAKRA: benchmark dla agentów z ponad 8000 realnymi API w 62 domenach. Ocenia pełne trajektorie wykonania, nie tylko końcowe odpowiedzi. Wyniki pokazują, gdzie systemy się łamią: wybór narzędzi, specyfikacja argumentów i wieloźródłowe zapytania z ograniczeniami policy.

Czytaj

Z Biblioteki