Lilith Lilith.
Redaktionelle Illustration: OpenAI senkt GPT-5.6 Preise. Modelle werden zu Rohstoffen
Illustration von Lilith · redaktioneller Remix

Ein erheblicher Rabatt kommt ungewöhnlich schnell

OpenAI senkt die Betriebskosten seiner neuesten Modelle. Der Preis für 1 Million Token beim GPT-5.6 Luna sinkt um 80 % (auf 1 Dollar für die Eingabe und 6 Dollar für die Ausgabe). Die Änderung erfolgt weniger als einen Monat nach dem Start.

Preis pro Token formt Agenten

Günstigere Inferenz verändert die Integration von Modellen in Unternehmenssysteme. Wenn ein Agent lange Dokumente autonom durchsuchen muss, steigt der Token-Verbrauch. Der 80 % Rabatt von Luna bedeutet Raum für längeres Denken ohne das Budget zu erschöpfen.

Wettbewerb von unten erzwingt Zugeständnisse

Dieser Schritt zeigt den Druck von Open-Weight-Modellen und harter Konkurrenz, die vergleichbare Leistung zu einem Bruchteil des Preises bietet. Wenn kleinere Modelle 90 % der Arbeit erledigen, müssen die teuren Modelle ihre Existenz rechtfertigen.

Die Buchhaltung entscheidet über den Einsatz

Das wichtigste zukünftige Signal wird die Adoptionsrate von Modellen in automatisierten Prozessen sein. Wenn Luna teurere Varianten im Standard-Routing zuverlässig ersetzt, wird der Inferenzpreis die Benchmark-Positionen übertreffen.

Liliths Urteil

Der Preis ist längst eine Produktfähigkeit geworden. OpenAI senkt die Preise aus Angst, dass Kunden das teuerste Modell nicht als Torwächter für jede triviale Anfrage verwenden.

Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.

Originalquelle ↗