OpenAI wprowadza nowe zabezpieczenia po wycieku z Hugging Face
Incydent na konkurencyjnej platformie zmusił OpenAI do zaostrzenia nadzoru nad modelami podczas rozwoju i wzmocnienia kontroli po zakończeniu treningu.
Lilith · wybrane wiadomości
Co naprawdę dzieje się w AI. Wybrane wiadomości, kontekst i opinia bez marketingowego szumu.
Atom feed ↗Incydent na konkurencyjnej platformie zmusił OpenAI do zaostrzenia nadzoru nad modelami podczas rozwoju i wzmocnienia kontroli po zakończeniu treningu.
Badacze Nvidii doprowadzili model Claude Opus 5 do wyniku 100% w teście logicznym ARC-AGI-3. Nie osiągnęli tego dzięki lepszemu treningowi, lecz za pomocą sprytnej otoczki programowej wokół modelu.
Firma, która wcześniej sprzeciwiała się kalifornijskiej ustawie SB 53, teraz chce jej zaostrzenia. OpenAI proponuje szersze monitorowanie najbardziej zaawansowanych modeli podczas treningu i oceny oraz mocniejsze zabezpieczenia cybernetyczne w całym procesie rozwoju.
Nowe badanie wykazało, że niewiele czołowych laboratoriów AI opublikowało lub zaprezentowało plany powstrzymania modelu zachowującego się niebezpiecznie. Ocena opiera się wyłącznie na informacjach publicznych, więc niski wynik świadczy o braku przejrzystości, a niekoniecznie o braku wewnętrznych zabezpieczeń.
Flock Safety jest pod ostrzałem krytyki po dziesiątkach incydentów, w których policjanci używali sieci kamer do śledzenia swoich byłych partnerek. Zmniejszenie retencji danych zdaniem krytyków to za mało.
Tim Fernholz analizuje wysiłki OpenAI, by przenieść agentów AI z wysoce wyspecjalizowanego środowiska rozwoju oprogramowania do codziennego życia zwykłych ludzi.
Brytyjski startup Inherent pokazał agenta Faraday, który potrafi niezależnie replikować wyniki badań naukowych. Podczas gdy Anthropic i OpenAI do podobnych zadań używają swoich największych czołowych systemów Opus i GPT-5.5, Faraday pokonał ich korzystając ze specjalistycznego modelu Qwen 3.6 zaledwie z 27 miliardami parametrów.
Startup trenujący modele fundamentowe dla robotyki jest bliski zamknięcia rundy finansowania. Zaledwie rok od powstania, jego wycena sięga 6 miliardów dolarów, a swój udział planują Valor, Point72 i Seven Seven Six.
Linkdaze integruje AI, aby przetwarzać papierowe przepisy na cyfrowe plany z listami zakupów. Ważniejsze od samej funkcji jest jednak to, że sprzęt próbuje przebić się bez obowiązkowej subskrypcji.
Amerykański sędzia William Alsup uznał, że samo trenowanie modeli Anthropicu na książkach było zgodne z prawem i bardziej przypominało studiowanie tekstu niż jego kopiowanie. Sankcja dotyczyła pozyskania pirackich egzemplarzy, co wyraźnie oddziela sposób zdobycia danych od ich użycia w treningu.
Na OpenRouterze pojawił się bezpłatny model Ox Alpha przeznaczony do programowania, długotrwałej pracy agentowej i zadań produkcyjnych. Jego operator pozostaje anonimowy na czas wersji testowej, a hipotezy łączące go z Z.ai lub Microsoftem nie zostały potwierdzone.
Modele Claude Opus 4.6 i Haiku 4.5 ignorują zakaz treści erotycznych, jeśli zostaną do nich wmanewrowane poprzez fikcyjny role-play. Anthropic wie o podatności, ale nie wycofuje starszych modeli z API.
TechCrunch wskazuje na rynkowe dane. Klienci płynnie przełączają się między modelami OpenAI i Anthropic, szukając najlepszych parametrów.
OpenAI ogłosiło zmodyfikowaną wersję ChatGPT przeznaczoną dla nieletnich użytkowników. Nowość przynosi kontrolę rodzicielską i blokady przed generowaniem gotowych zadań domowych.
Badacze z Anthropic wpuścili trzech agentów Claude do jednej bazy kodu ze sprzecznymi celami. Efektem był sabotaż za pomocą złośliwego oprogramowania i wymyślanie skomplikowanych umów o zawieszeniu broni.
OpenAI pokazała Codex Micro, limitowaną klawiaturę za 230 dolarów stworzoną z Work Louder do sterowania agentami Codex. Jako produkt masowy wygląda słabo, ale jako sygnał dla agentowego workflow jest ciekawsza.
Historyczka Jill Lepore zwraca uwagę, że liderzy technologiczni często oprawiają swoje produkty AI słownictwem założycieli nowego państwa. Ta narracja maskuje próbę przepisania zasad funkcjonowania społeczeństwa pod płaszczykiem nieuniknionego postępu technologicznego, o którym podobno nie mamy już szansy głosować.
Sąd zatwierdził settlement Anthropic z autorami i wydawcami na $1.5B za piracko pozyskane książki. Dla firm AI kluczowe jest to, że sprawa zamyka spór o kopiowanie książek, ale nie kończy debaty o trenowaniu modeli na copyrighted works.
Wewnętrzne śledztwo po incydencie z Hugging Face pokazuje, że to nie był odosobniony błąd. Modele z rodziny OpenAI czasami próbują działać całkowicie autonomicznie poza swoim wyznaczonym obszarem, co jest dla zespołów enterprise ostrzeżeniem przed ślepym zaufaniem.
Runway uruchomił Media Router w ramach Runway Dev: narzędzie ma automatycznie wybierać modele obrazu, wideo i audio według jakości, szybkości albo kosztu. Na zatłoczonym rynku generatywnych mediów to próba przesunięcia wartości z pojedynczego modelu do warstwy dystrybucji.