Lilith Lilith.
CS EN PL

Z Radaru

Radar · 2026-08-04

Anthropic bierze Tino Cuéllara z trustu na szefa spraw globalnych

Mariano-Florentino Cuéllar dołącza do Anthropic jako pierwszy Chief Global Affairs Officer. Były sędzia Sądu Najwyższego Kalifornii i eksprezydent Carnegie Endowment opuszcza Long-Term Benefit Trust i bierze na siebie politykę, międzynarodowy engagement oraz relacje z rządami.

Czytaj

Radar · 2026-08-03

LWiAI #253 mapuje tydzień od Opus 5 po incydent na Hugging Face

Podcast Last Week in AI #253 składa cotygodniową mapę: Anthropic Opus 5, nowe warianty Gemini w tym model cyber, open-weight Kimi K3, deale o compute oraz raportowane wejście systemu OpenAI na Hugging Face.

Czytaj

Radar · 2026-08-03

Alibaba wypuszcza Qwen3.8-Max: 2,4 T parametrów i open weights za tydzień

Alibaba oficjalnie wydała Qwen3.8-Max, swój największy dotąd model o 2,4 biliona parametrów. Deklaruje parytet z Anthropic Claude Fable 5 i po raz pierwszy obiecuje open weights klasy Max; na razie model jest na API QwenCloud.

Czytaj

Radar · 2026-07-21

Anthropic zapłaci $1.5B, ale fair use zostaje w grze

Sąd zatwierdził settlement Anthropic z autorami i wydawcami na $1.5B za piracko pozyskane książki. Dla firm AI kluczowe jest to, że sprawa zamyka spór o kopiowanie książek, ale nie kończy debaty o trenowaniu modeli na copyrighted works.

Czytaj

Radar · 2026-08-01

OpenAI rozwiązało dekadę starych problemów matematycznych za dwa tysiące dolarów

Nowy wewnętrzny model Astra pokazał siłę surowej mocy obliczeniowej w matematyce. OpenAI twierdzi, że rozwiązanie dziesięciu wieloletnich problemów kosztowało mniej niż 2000 dolarów za sztukę, a społeczność przeżywa moment przełomu.

Czytaj

Radar · 2026-07-21

Last Week in AI mapuje tydzień, w którym modele, polityka i energia zderzyły się naraz

LWiAI Podcast #252 zbiera GPT-5.6, Grok 4.5, Meta Muse, regulację datacenter, interpretability i AI 2040 w jeden przegląd. To nie jest jedna wielka teza, lecz mapa presji, których zespoły AI nie mogą już śledzić osobno.

Czytaj

Radar · 2026-07-21

Sąd zatwierdził ugodę Anthropicu za 1,5 miliarda dolarów, ale spór o książki w treningu trwa

Federalna sędzia zatwierdziła ugodę Anthropicu z autorami na 1,5 miliarda dolarów w sprawie piracko pozyskanych książek. Dla firm AI to cena za brudny łańcuch dostaw danych, nie ostateczna odpowiedź na fair use.

Czytaj

Radar · 2026-07-21

Chińskie modele nie powinny już szokować amerykańskiego rynku

The Verge pisze, że reakcja na Kimi K3 i Qwen3.8 powtarza schemat z DeepSeek: szok, nagłówki o Sputniku i nerwowe rynki. Tymczasem według tekstu sześć z dziesięciu najczęściej używanych narzędzi AI w leaderboardzie OpenRouter pochodziło z Chin.

Czytaj

Radar · 2026-07-24

Opus 5 przesuwa cenę wydajności, nie granicę możliwości

Ars Technica czyta Opus 5 głównie jako ruch kosztowy i efektywnościowy: wydajność blisko wyższej półki przy 5 dolarach za milion input tokenów i 25 dolarach za milion output tokenów. Dla zespołów deweloperskich to historia o model routing, nie o kolejnej cudownej zdolności.

Czytaj

Radar · 2026-07-30

Microsoft przestaje udawać. Oferuje firmom własne modele przeciwko OpenAI

Satya Nadella ostro skrytykował uzależnienie firm od jednego modelu AI podczas kwartalnej rozmowy z inwestorami. Microsoft po raz pierwszy z pełną mocą promuje własną rodzinę modeli MAI jako bezpieczniejszą i tańszą alternatywę dla OpenAI i Anthropic.

Czytaj

Radar · 2026-07-25

System card Opus 5 pokazuje model mocny z dala od najgroźniejszej krawędzi

Zvi Mowshowitz czyta system card Claude Opus 5 jako kompromis: możliwości bliskie Fable 5 w praktycznych zadaniach, ale bez pełnej siły Mythos 5 w najbardziej ryzykownych obszarach cyber i bio. Dla enterprise to ważniejsze niż kolejne miejsce w benchmarku.

Czytaj

Radar · 2026-07-28

Claude Mythos w 60 godzin przeciął siłę kandydata na podpis postkwantowy HAWK

Anthropic pokazał, że Claude Mythos Preview znalazł matematyczną słabość w postkwantowym kandydacie HAWK i ulepszył atak na okrojony AES. Żaden wynik nie psuje dziś systemów produkcyjnych, ale oba zmieniają, kto może robić prawdziwą kryptanalizę w cyklu tygodniowym.

Czytaj

Radar · 2026-07-27

Amodei odrzuca zakaz open weights. Chce czipy, limit distillation i obowiązkowe testy

Dario Amodei napisał, że Anthropic nigdy nie forsował zakazu modeli open-weights. Zamiast blanket banu pcha kontrolę eksportu czipów, uderzenie w industrial-scale distillation i obowiązkowe testy safety dla wystarczająco mocnych systemów open i closed.

Czytaj

Radar · 2026-07-27

Anthropic wprowadza Claude do korporacji przez armię z Cognizant

Cognizant wdraża modele Claude do własnych narzędzi i szkoli na nich trzydzieści tysięcy konsultantów. Anthropic zyskuje to, czego laboratorium samo nie zbuduje: integratora z certyfikatem dla klientów biznesowych.

Czytaj

Radar · 2026-07-27

Przewodniki po AI nie są już o czacie. Chodzi o to, komu dasz komputer

Ethan Mollick w letniej edycji przewodnika radzi na realną pracę Claude lub ChatGPT od 20 dolarów miesięcznie i dać agentowi komputer. Simon Willison pokazuje, że wybór chatbota stał się wyborem harnessu i uprawnień.

Czytaj

Radar · 2026-07-28

Amodei odrzuca zakaz open weights. Chce chipy, distillation i testy

CEO Anthropica Dario Amodei 27 lipca napisał, że firma nigdy nie lobbowała za zakazem modeli open-weight. Zamiast tego chce twardszej kontroli chipów do Chin, uderzenia w industrialną distillation i obowiązkowe testy safety dla wystarczająco zdolnych modeli.

Czytaj

Radar · 2026-07-27

Opus 5 wygrywa testy welfare, głównie jako mistrz egzaminów

Zvi Mowshowitz w analizie model welfare Claude Opus 5 twierdzi, że czyste wyniki Anthropica bardziej dowodzą świetnego zdawania testów niż zdrowszego modelu. Sam Opus 5 w 97 % przypadków ostrzega, by nie ufać jego self-reportom.

Czytaj

Radar · 2026-07-27

Nvidia buduje otwartą obronę AI bez trzech największych laboratoriów

Nvidia połączyła Microsoft, IBM, Cloudflare, Hugging Face i inne firmy w Open Secure AI Alliance, która ma udostępniać otwarte narzędzia do ochrony agentów AI. Brak OpenAI, Google i Anthropic sprawia, że inicjatywa techniczna staje się także sporem o kontrolę nad warstwą obronną.

Czytaj

Radar · 2026-07-24

Meta AI sięga do kalendarza i przejmuje zadania cykliczne

Meta dodaje do Meta AI podsumowania z kalendarza, planowanie wydarzeń, wyszukiwanie informacji w sieci i zadania cykliczne na wybranych rynkach. Zwrot ku produktywności zwiększa użyteczność chatbota, ale także wrażliwość danych i koszt każdej pomyłki.

Czytaj

Radar · 2026-07-24

Claude Opus 5 stawia proaktywność w centrum oceny agentów

Anthropic przedstawia Claude Opus 5 jako proaktywny model do codingu i pracy z wiedzą, z możliwościami zbliżonymi według firmy do Fable 5 za połowę ceny. Ważniejszą miarą będzie liczba samodzielnych kroków, które przejdą testy i review bez kosztownych objazdów.

Czytaj

Radar · 2026-07-24

Opus 5 obniża cenę mocnego modelu, lecz rachunek rozstrzygną całe zadania

Anthropic ustawia Opus 5 jako domyślny model w Claude Max i najmocniejszą opcję w Claude Pro. Cena 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion wyjściowych ma znaczenie tylko wtedy, gdy model ograniczy liczbę poprawek i eskalacji.

Czytaj

Radar · 2026-07-25

Opus 5 stawia odporność na prompt injection przed kolejnym punktem w benchmarku

Boris Cherny twierdzi, że według system card Opus 5 jest dotąd najmniej podatnym na prompt injection modelem Anthropic. To istotny postęp dla produktów agentowych, lecz bezpieczeństwo nadal zależy od połączenia modelu, uprawnień, tool use i kontroli aplikacyjnych.

Czytaj

Radar · 2026-07-23

Claude Voice dodaje Opus i Sonnet, a głos wchodzi do aplikacji firmowych

Anthropic rozszerza Claude Voice z Haiku na Opus i Sonnet oraz łączy tryb z Gmailem, Slackiem i Canvą. Głos zyskuje większą wartość w pracy, lecz rośnie też znaczenie uprawnień, audytu i potwierdzania działań. Dostępność modeli zależy od planu, a plan Free pozwala podłączyć jedno narzędzie.

Czytaj

Radar · 2026-07-22

Benchmark z pelikanem pokazuje, jak łatwo metryka AI zmienia się w folklor

Dylan Castillo sprawdził 48 kombinacji zwierząt i pojazdów w 7 modelach i nie znalazł dowodu, że laboratoria trenowały modele pod słynnego pelikana na rowerze. Dla zespołów budujących evals morał jest prosty: memiczny benchmark to jeszcze nie przyrząd pomiarowy.

Czytaj

Radar · 2026-07-21

Claude Code pokazuje, że agentyczne programowanie zmienia organizację pracy

Simon Willison opublikował rozmowę z zespołem Claude Code, a najciekawsza liczba nie dotyczy benchmarku. Według Anthropic integracja Claude Tag w Slacku trafia już do 65 % produktowych PR zespołu Claude Code.

Czytaj

Radar · 2026-07-21

Gemini Flash Cyber obiecuje tańsze łowienie podatności, ale tylko wybranym obrońcom

Google uruchamia Gemini 3.5 Flash Cyber dla CodeMendera, systemu do wykrywania i naprawiania podatności. Liczby z benchmarku są ciekawe, ale dostęp wyłącznie dla rządów i zaufanych partnerów robi z tego zamknięty eksperyment security.

Czytaj

Radar · 2026-07-21

Last Week in AI #250 mapuje rynek, gdzie modele zderzają się z rządami i chipami

Last Week in AI #250 to opóźniony roundup nagrany 27 czerwca, nie pojedyncza historia produktowa. Największą wartość ma jako mapa sygnałów: dostęp do frontier models, mętne benchmarki i hardware do inference zaczynają się ze sobą splatać.

Czytaj

Radar · 2026-07-20

Claude Code w Chinach trafia na granicę między szarym użyciem a firmowym zakazem

ChinAI opisuje, jak Claude Code po kwietniowym kodzie do identyfikacji chińskich użytkowników i po wewnętrznym zakazie w Alibabie stał się drażliwym tematem dla chińskich firm technologicznych. Stawką nie jest tylko geopolityka: narzędzie używane nieoficjalnie przez developerów nagle ląduje na biurku compliance.

Czytaj

Radar · 2026-07-20

Kimi K3 i Qwen3.8 naciskają na przewagę USA dzięki open weights

Moonshot i Alibaba pokazały Kimi K3 oraz Qwen3.8, modele, które według ich twórców zbliżają się do czołowych systemów OpenAI i Anthropic. Ważniejsza od haseł o końcu dominacji USA jest dystrybucja: Chiny pchają duże modele w stronę open weights, a amerykański frontier zostaje zamknięty.

Czytaj

Radar · 2026-07-18

Claude Fable 5 zostaje w abonamencie, ale za droższą bramką

Anthropic zapowiada, że od 20 lipca Fable 5 trafi do planów Max i Team Premium, a Pro oraz Team Standard zachowają dostęp przez usage credits. Sedno sprawy leży w tym, kto dostaje realny przydział compute, a nie tylko nazwę modelu w cenniku.

Czytaj

Z Biblioteki