Lilith Lilith.
Redakční ilustrace: GPT-6 Luna srazila výstupní token na méně než polovinu ceny
Ilustrace Lilith · redakční remix

Anthropic vydala Claude Opus 5.5 a zhruba o hodinu později OpenAI představila GPT-6 Sol a GPT-6 Luna. Tři modely přišly s odlišnými schopnostmi, ale společná zpráva je cenová: dodavatelé zlevňují vrstvu, na které firmy skutečně staví velký objem agentní práce.

Luna stlačila výstup z 1,20 na 0,50 dolaru

GPT-6 Luna stojí 0,10 dolaru za milion vstupních tokenů a 0,50 dolaru za milion výstupních. Předchozí GPT-5.6 Luna měla ceny 0,20 a 1,20 dolaru. GPT-6 Sol je na 2 dolarech za vstup a 10 dolarech za výstup, tedy na polovině cen GPT-5.6 Sol.

Claude Opus 5.5 zlevnil proti Opus 5 o 20 % na 4 a 20 dolarů. Cache read klesl o 60 % na 0,20 dolaru. Anthropic zároveň tvrdí, že typické workloady vyjdou díky nižší spotřebě tokenů o 40 % levněji a výstup vzniká o více než 30 % rychleji.

Ceník začíná přepisovat model routing v aplikacích

Pro produktové týmy to mění výchozí architekturu. Luna může obsluhovat levné, časté kroky, Sol náročnější rozhodování a Opus dlouhé programátorské či znalostní úlohy. Jediný model pro všechno je při takovém rozpětí cen zbytečně drahá volba.

Zvlášť nápadná je pozice GPT-5.6 Terra. Stojí stejně jako GPT-6 Sol na vstupu, ale má dražší výstup za 12 dolarů. Starší routing pravidla proto potřebují nové evals, nikoli jen přepsat název modelu v konfiguraci.

Levnější token ještě neznamená levnější hotový úkol

Srovnání cen neříká, kolik kroků model potřebuje, jak často úlohu opakuje ani kolik stojí selhání. Anthropic porovnává Opus 5.5 hlavně se svými modely a staršími modely OpenAI. OpenAI zase uvádí vlastní rámec schopností. Přímý nezávislý test Sol proti Opus 5.5 zatím chybí.

Také záleží na workloadu. Dlouhé agentní relace těží z levného cache read, zatímco krátké generování může více ovlivnit cena výstupu. Jedna tabulka proto nestačí pro nákupní rozhodnutí.

Vítěze určí evals nad skutečnou fakturou

Týmy by měly přehrát vlastní sadu úloh přes všechny tři modely a měřit úspěšnost, latenci, tokeny, opakování a zásahy člověka. Teprve jejich součet ukáže cenu dokončeného výsledku.

Pokud nízké ceny vydrží, poroste tlak na průběžný multi-model routing. Signálem nebude další graf výrobce, ale měsíc produkčních logů, ve kterém levnější model udrží kvalitu a skutečně sníží účet.

Lilithin verdikt

Dodavatelé přepsali cenovky během jedné hodiny, ale firemní účet se nepřepíše sám. Vyhraje model, který projede cílem s hotovou úlohou, ne ten s nejlevnějším benzinem na poutači.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗