Lilith Lilith.
Ilustracja redakcyjna: Analiza 500 tysięcy publikacji dowodzi, że chińskie modele stają się punktem wyjścia dla badaczy
Ilustracja Lilith · remiks redakcyjny

Większość tego, co wiemy o adopcji modeli, pochodzi z benchmarków lub marketingowych komunikatów prasowych, a nie z twardych danych. Nathan Lambert zlecił modelowi Codex analizę ponad pół miliona publikacji AI/ML wydanych na arXiv od momentu debiutu ChatGPT. Szukał w nich konkretnych wzmianek o wykorzystaniu otwartych modeli w pracy badawczej.

Analiza ujawnia zmianę układu sił. W 2024 roku około 30% publikacji wspominało o otwartym modelu amerykańskim, a tylko 10% o chińskim. Dziś 40% prac wskazuje na chiński otwarty LLM, podczas gdy modele amerykańskie utrzymują się na poziomie 25 do 30% i przestały rosnąć.

Qwen staje się globalnym standardem dla laboratoriów

Dane pokazują silną inercję w procesie adopcji. Prowadzenie badań i publikacja pracy trwają miesiące, więc cytowania akademickie naturalnie pozostają w tyle za premierami o jeden lub dwa cykle. Dziś jedna trzecia wszystkich prac wspominających o jakimkolwiek LLM wymienia model Qwen od Alibaby. Z kolei Llama od Mety osiągnęła swój szczyt około kwietnia 2025 roku w mniej więcej jednej trzeciej prac i od tego czasu jej udział systematycznie spada.

Ciekawa jest rola zamkniętych gigantów komercyjnych. Mimo że otwarte modele napędzają własne wysiłki badawcze, OpenAI i jego modele utrzymują łącznie najwyższy wskaźnik wzmianek na poziomie około 37%. Claude od firmy Anthropic i Gemini od Google pozostają daleko w tyle za modelami Qwen, Llama i DeepSeek.

Cytowania oddają tylko to, co autorzy ujawnią

Wzrost znaczenia DeepSeek po premierze wersji R1 w styczniu 2025 roku jest wyraźnie widoczny w danych jako ostry skok, jednak zbiory z arXiv wciąż przechwytują wyłącznie to, co naukowcy są skłonni napisać w swoich tekstach. Ponadto analiza ogranicza się do nauk komputerowych, gdzie powoływanie się na architekturę jest standardową praktyką.

Poza obszarem uczenia maszynowego, w naukach humanistycznych i wdrożeniach klasy enterprise, udziały rynkowe będą wyglądać inaczej. Tam nie ma powodu do przejmowania się otwartymi wagami i licencjonowaniem, a decydującym czynnikiem staje się interfejs API lub przeglądarkowy.

Śledzenie wpływów open-source w czasie rzeczywistym

Kolejne generacje otwartych modeli po obu stronach Pacyfiku wkrótce pokażą, czy amerykańskim graczom uda się odwrócić spadkową krzywą wpływu akademickiego, czy też Qwen pozostanie domyślną infrastrukturą globalnej nauki. Decydująca będzie tu adopcja nowych wersji na poszczególnych kontynentach. Zgromadzone przez Lamberta dane są na bieżąco aktualizowane na platformie Interconnects Open Model Dashboard.

Zależność od jednej platformy niesie ryzyko akademickie

Otwarte podejście chińskich laboratoriów de facto dotuje obecnie globalne badania akademickie. Dopóki to trwa, badacze mają do dyspozycji potężne narzędzia za darmo, ale strategiczna zależność od zasobów poza ich bezpośrednią kontrolą może stanowić problem w przypadku zmiany licencji.

Werdykt Lilith

Ograniczony budżet akademicki oznacza dziś, że Ameryka nie dostarcza ci już automatycznie najlepszych otwartych kluczy do prowadzenia badań.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗