Lilith Lilith.
Ilustracja redakcyjna: Pętla się zamyka: Ludzie trenujący ChatGPT zwolnieni za używanie ChatGPT do pracy
Ilustracja Lilith · remiks redakcyjny

Ludzki dotyk za pośrednictwem maszyny

Armia zewnętrznych podwykonawców, którzy czytają i oceniają interakcje użytkowników z ChatGPT dla OpenAI, ma jedną surową zasadę: nie mogą pomagać sobie sztuczną inteligencją w pracy. Magazyn 404 Media odkrył, że rzesze tych tzw. „recenzentów” (reviewers) zostały zwolnione właśnie dlatego, że zignorowały zakaz i używały AI do generowania danych mających trenować kolejne generacje ChatGPT.

Ten ludzki czynnik ma uczyć modele naturalności i eliminować niepożądane cechy. Ale kiedy wykonawcy, w pośpiechu, aby wyrobić normy, zastępują ludzki wkład kolejną iteracją AI, prowadzi to do tzw. załamania modelu (model collapse). Jest to pogorszenie jakości spowodowane tym, że algorytm uczy się z własnych danych syntetycznych zamiast z prawdziwych opinii ludzi.

Łowcy śledzący podejrzaną prędkość

Dokumenty uzyskane przez 404 Media wskazują na zaawansowany system kontroli. OpenAI zatrudnia kolejną warstwę podwykonawców, których zadaniem jest łapanie oszustów. Paradoksalnie, ci kontrolerzy również mają zakaz używania narzędzi do wykrywania AI (takich jak GPTZero), ponieważ uważa się je za niewiarygodne. Mają również zakaz korzystania z tłumaczy opartych na sztucznej inteligencji czy sprawdzania gramatyki.

Zgodnie z instrukcjami, główne sygnały oszukiwania obejmują powtarzające się słownictwo, typową „interpunkcję AI” (w tym nadużywanie pauz) i przede wszystkim zbyt szybkie oddawanie pracy przez wykonawcę. Inspektorom nie wolno mówić oszustom, w jaki sposób zostali złapani, aby ci nie mogli ulepszyć swoich metod tuszowania.

Fabryka wypalenia zawodowego

Jeden z poszkodowanych wykonawców skomentował, że nie czuł się złym pracownikiem; po prostu potrzebował ulgi od monotonnej pracy. Inny przyznał się do celowego wybierania najgorszych możliwych odpowiedzi, aby celowo sabotować modele, ponieważ czuł, że jego praca nie przynosi żadnych pozytywnych korzyści dla społeczeństwa.

Firma Mercor, która zatrudnia podwykonawców dla OpenAI, potwierdziła, że zasady surowo zabraniają korzystania z dużych modeli językowych i że intensywnie inwestuje w narzędzia do wykrywania. Gdy tylko użycie sztucznej inteligencji zostanie potwierdzone, pracownik jest natychmiast usuwany z projektu.

Kiedy produkt przeczy procesowi

Najciekawszą częścią całego incydentu jest paradoks firmy, która go wywołała. OpenAI opiera swój biznes na przekonywaniu świata do korzystania ze sztucznej inteligencji w pracy w celu przyspieszenia i automatyzacji nudnych zadań. Ale kiedy robią to ludzie szkolący właśnie tę technologię, zostają zwolnieni.

Obnaża to słabość obecnego ekosystemu AI, który jest fundamentalnie uzależniony od nieskończonej podaży taniej, „autentycznej” ludzkiej pracy. Ponieważ modele wymagają coraz większej ilości danych, presja na szybkość przetwarzania rośnie. Ludzie naturalnie zwracają się o pomoc do narzędzi, które sami mają ulepszać.

Werdykt Lilith

Ironia całej branży AI w jednym przypadku. Obiecują firmom, że AI uwolni pracowników od żmudnej pracy, ale kiedy to samo robią robotnicy w ich własnej fabryce danych, wylatują na bruk.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗