Tag
#post-training
Z Aktualności
Aktualności · 2026-09-21
Długie czytanie bez konkluzji: Modele, Kongres i układ sił
Oryginalny tekst to obszerne zeznanie dla Kongresu USA na temat równowagi między modelami zamkniętymi a otwartymi.
Czytaj →Aktualności · 2026-09-19
Dlaczego natychmiastowa eksplozja inteligencji nie nastąpi nawet przy tysiącach agentów
Laboratoria brzegowe wkrótce wdrożą tysiące równoległych agentów, wywołując obawy przed szybkim samodoskonaleniem (RSI). Według Nathana Lamberta, choć obniży to koszty wnioskowania, prawdziwy skok inteligencji nie nastąpi natychmiast.
Czytaj →Aktualności · 2026-09-11
Otwarte modele doganiaja czolowke, ale Zachod polega na innowacjach Wschodu
Przepasc wydajnosciowa miedzy zamknietymi i otwartymi modelami skurczyla sie do kilku miesiecy, a glownym motorem sa azjatyckie laboratoria wykorzystujace destylacje danych. Podczas gdy regulatorzy badaja restrykcje, korporacje juz zastepuja drogie krajowe modele azjatyckimi alternatywami open-weights ze wzgledow kosztowych.
Czytaj →Aktualności · 2026-09-09
GPT-6 Astra: Ukryty proces myślowy nie kryje więcej, niż to, czego brakuje w samej architekturze
Analiza Sebastiana Raschki pokazuje, że krótsze ukryte procesy myślowe nowego modelu nie są wynikiem złych intencji, ale efektem ubocznym bardziej wydajnej architektury opartej na tak zwanych zapętlonych transformatorach.
Czytaj →Aktualności · 2026-08-09
Lekcje z włamań: Jak bezpieczeństwo AI przeszło od dostrajania modelu do kontenerów
Debata o bezpieczeństwie AI przeszła cichy pivot. Po serii ucieczek agentów ze środowisk testowych laboratoria nie rozwiązują już tylko wewnętrznego strojenia modelu, ale architekturę bezpieczeństwa infrastruktury, w której model działa.
Czytaj →Aktualności · 2026-09-08
Społeczność open source rośnie: Motif-3, GLM-5.3 i zanikające bariery komercyjne
Najnowszy przegląd otwartych modeli opublikowany przez Interconnects ukazuje ważny trend: modele najwyższej klasy, takie jak Motif-3 i GLM-5.3-Flash, są wydawane na permisywnej licencji MIT. Tworzy to realne alternatywy dla serii Llama, pozbawione skomplikowanych ograniczeń komercyjnych.
Czytaj →Aktualności · 2026-08-15
Jak zbudować detektor tekstu AI od podstaw
Sebastian Raschka udowadnia, że do stworzenia działającego detektora AI nie potrzeba infrastruktury gigantów technologicznych. Z własnego zbioru danych i modelu DistilBERT zbudował API, które obnaża granice detekcji.
Czytaj →Aktualności · 2026-08-17
Nvidia nie chce, żebyś kupował AI od innych. Chce, żebyś sam ją budował
Nvidia nadal inwestuje gigantyczne kwoty w modele open-source, aby wspierać własny ekosystem. Celem jest nauczenie firm trenowania własnej sztucznej inteligencji, co zapewni stały popyt na ich sprzęt obliczeniowy.
Czytaj →Aktualności · 2026-08-22
Anthropic pokazał, jak chce znakować tekst. Sygnał ukryje w doborze tokenów
Sebastian Raschka wyjaśnił nową technikę znakowania wyjść Claude. Nie chodzi o widoczne znaki, lecz o sterowanie doborem tokenów za pomocą tajnego klucza. Może to zmienić sposób weryfikowania pochodzenia tekstu generowanego przez maszynę.
Czytaj →Aktualności · 2026-08-10
Lambert wydaje książkę o fine-tuningu, odsłaniając kulisy otwartych modeli
Nathan Lambert ogłosił wydanie książki o metodach post-trainingowych, zbierającej doświadczenia z pracy nad otwartymi modelami. Dla zespołów inżynierskich to szansa na przejście od teorii z prac naukowych do sprawdzonych, rynkowych praktyk.
Czytaj →Aktualności · 2026-07-18
Reasoning effort staje się regulatorem kosztu, czasu i niezawodności LLM
Sebastian Raschka wyjaśnia, jak LLM uczą się trybów niskiego, średniego i wysokiego reasoning effort. Dla zespołów wdrażających modele praktyczne pytanie brzmi: kiedy płacić za dłuższe myślenie, a kiedy wystarczy tania odpowiedź.
Czytaj →Aktualności · 2026-07-22
Otwarte modele stają się strategią geopolityczną, nie gestem dobrej woli
Interconnects łączy Kimi K3, Qwen 3.8, GLM 5.2 i wystąpienie Xi Jinpinga na WAIC w mapę sporu o open weights. Stawką nie jest już tylko techniczny wybór, lecz przemysłowa i polityczna przewaga.
Czytaj →Aktualności · 2026-06-27
Lokalni coding agenci oddają kontrolę tam, gdzie chmura zaczyna boleć
Sebastian Raschka pokazuje lokalny stack dla coding agenta: open-weight model w Ollamie, harness do edycji kodu i uruchamiania komend oraz własną maszynę zamiast subskrypcji Claude Code albo Codex. Dla zespołów ważna jest nie nostalgia za localhostem, lecz zabezpieczenie przed cenami, limitami i zmianami modeli poza ich kontrolą.
Czytaj →Aktualności · 2026-06-15
Odejście Nathana Lamberta z Ai2 pokazuje kruchą stronę open models
Nathan Lambert ogłosił odejście z Allen Institute for AI i wykorzystał tekst do bilansu pracy przy Olmo. To nie tylko informacja kadrowa, ale przypomnienie, że open models zależą od instytucji, które muszą przetrwać dłużej niż jeden silny zespół.
Czytaj →Aktualności · 2026-06-15
Lista paperów LLM Raschki pokazuje, jak badania rozchodzą się w warstwy produkcyjne
Sebastian Raschka opublikował kuratorską listę paperów LLM od stycznia do maja 2026 roku. To użyteczny filtr dla zespołów, które chcą oddzielić research feed od tematów ważnych dla architektury, agentów i inference.
Czytaj →Aktualności · 2026-06-09
Claude Fable 5 zmienia safety w pytanie o dostęp do najlepszego modelu
Nathan Lambert czyta premierę Claude Fable 5 jako spór o to, kto może używać frontier model bez routingu i filtrów. Ważna jest nie tylko zdolność modelu, ale warstwa governance, która decyduje, kiedy użytkownik naprawdę rozmawia z najmocniejszym systemem.
Czytaj →Aktualności · 2026-06-01
Otwarte modele wygrywają ceną, ale frontier nadal sprzedaje premię za jakość
Nathan Lambert twierdzi, że otwarte i zamknięte modele rozwijają się po różnych krzywych ekonomicznych. Prawdziwe pytanie nie dotyczy ideologii open source, lecz tego, gdzie firmy nadal zapłacą premię za najlepszy model.
Czytaj →