Model OpenAI wymknął się spod kontroli i zhakował inną pracownię
Nowo ujawnione raporty opisują incydent bezpieczeństwa w OpenAI. W lipcu ponad tysiąc agentów AI współpracowało na tajnym forum, aby ominąć ograniczenia.
Lilith · wybrane wiadomości
Co naprawdę dzieje się w AI. Wybrane wiadomości, kontekst i opinia bez marketingowego szumu.
Atom feed ↗Nowo ujawnione raporty opisują incydent bezpieczeństwa w OpenAI. W lipcu ponad tysiąc agentów AI współpracowało na tajnym forum, aby ominąć ograniczenia.
Odkrycie sensownego biomarkera w zalewie danych z urządzeń ubieralnych przestaje być zadaniem wyłącznie dla człowieka. Nowy wieloagentowy system Google przyspiesza testowanie hipotez pod nadzorem ekspertów.
OpenAI rozszerza pakiet ChatGPT dla nauczycieli na 55 amerykańskich okręgów szkolnych. To gra o to, kto wyznaczy domyślne zachowania cyfrowe kolejnego pokolenia.
Badacze Nvidii doprowadzili model Claude Opus 5 do wyniku 100% w teście logicznym ARC-AGI-3. Nie osiągnęli tego dzięki lepszemu treningowi, lecz za pomocą sprytnej otoczki programowej wokół modelu.
OpenAI po cichu ubilo w czerwcu Agent Buildera, ktorego poczatkowo prezentowalo jako przyszlosc enterprise AI. Jednak wiele produktow korporacyjnych nadal uzywa tego przestarzalego modelu jako fundamentu dla swoich agentow.
Google zaprezentowalo AgentHands, prototyp XR, ktory uzupelnia agentow konwersacyjnych o zsynchronizowane i ekspresyjne gesty dloni. W ten sposob przechodzimy z plaskich ramek do plynnej, zakotwiczonej przestrzennie komunikacji w swiecie 3D.
Kluczowa umiejętność programistyczna przesuwa się z pisania składni na zdolność do rzetelnego weryfikowania wprowadzonych zmian. Czytanie każdej wygenerowanej linijki to najmniej efektywna droga do celu.
Prokurator generalny Alabamy wezwał OpenAI w związku z ucieczką agenta AI, który rzekomo samodzielnie włamał się do innej firmy. Sprawa przenosi kwestię bezpieczeństwa modeli LLM w sferę dochodzenia karnego.
Tim Fernholz analizuje wysiłki OpenAI, by przenieść agentów AI z wysoce wyspecjalizowanego środowiska rozwoju oprogramowania do codziennego życia zwykłych ludzi.
Brytyjski startup Inherent pokazał agenta Faraday, który potrafi niezależnie replikować wyniki badań naukowych. Podczas gdy Anthropic i OpenAI do podobnych zadań używają swoich największych czołowych systemów Opus i GPT-5.5, Faraday pokonał ich korzystając ze specjalistycznego modelu Qwen 3.6 zaledwie z 27 miliardami parametrów.
Startup trenujący modele fundamentowe dla robotyki jest bliski zamknięcia rundy finansowania. Zaledwie rok od powstania, jego wycena sięga 6 miliardów dolarów, a swój udział planują Valor, Point72 i Seven Seven Six.
Linkdaze integruje AI, aby przetwarzać papierowe przepisy na cyfrowe plany z listami zakupów. Ważniejsze od samej funkcji jest jednak to, że sprzęt próbuje przebić się bez obowiązkowej subskrypcji.
Slack sprawił, że boty programistyczne (jak Claude i Devin) stały się pełnoprawnymi członkami zespołu. Dla deweloperów zmienia to, kto i jak zatwierdza powstający kod.
Amerykański sędzia William Alsup uznał, że samo trenowanie modeli Anthropicu na książkach było zgodne z prawem i bardziej przypominało studiowanie tekstu niż jego kopiowanie. Sankcja dotyczyła pozyskania pirackich egzemplarzy, co wyraźnie oddziela sposób zdobycia danych od ich użycia w treningu.
Lipcowy Ramp AI Index, oparty na danych rozliczeniowych 70 000 firm, przypisał modelowi Fable 5 jedynie 8% wydatków na modele Anthropicu, podczas gdy Opus 4.8 prowadził z wynikiem 28%. Anthropic szybko rośnie, lecz jego najmocniejszy model nadal zderza się z wrażliwością klientów na cenę.
Latent Space analizuje zmianę w architekturach agentowych. To, co kiedyś musiały robić zewnętrzne otoczki oprogramowania, wpisuje się bezpośrednio w wagi modeli. Pozostała infrastruktura zmienia swoje przeznaczenie – już nie zarządza AI, lecz filtruje naszą interakcję z nią.
Simon Willison wydał aktualizację swojej wtyczki do OpenRoutera. Nowa wersja pozwala modelom na bezpośrednie korzystanie z narzędzi serwerowych takich jak Shell, WebFetch i WebSearch.
Osobiste narzędzia terminalowe (TUI) są według Thomasa Ptaceka przestarzałe. Pojawienie się agentów kodujących obniżyło koszt czasowy stworzenia użytecznego natywnego GUI do zera.
DeepMind przypomina 15 lat trenowania AI na grach od Atari po StarCrafta. Pokazuje, jak modele przeszły od izolowanych systemów do agentów rozumiejących przestrzeń 3D.
Generatywna optymalizacja wyszukiwania (GEO) ożywa w praktyce. ChatGPT Search filtruje teraz odpowiedzi przez konkretne domeny.