2026-08-31 · ← News
Die Antwort auf Nvidia heißt Jalapeño. OpenAI veröffentlicht erste Zahlen
Eigene Hardware beginnt den Standard zu übertreffen
Während des Podcasts Last Week in AI am Wochenende gab es eine entscheidende Erwähnung von Jalapeño, der ersten Generation maßgeschneiderter KI-Hardware von OpenAI. Den veröffentlichten Zahlen zufolge schlägt der neue Inferenzchip aktuelle führende Systeme sowohl bei der Geschwindigkeit als auch beim Gesamtenergieverbrauch pro Token. Das Team von Sam Altman ebnet damit den Weg, die Abhängigkeit von Hardwarelieferungen Dritter schrittweise zu verringern, und plant, Jalapeño bis Ende dieses Jahres in seinen eigenen Rechenzentren einzusetzen.
Das Ende der endlosen Zahlungen für die Nvidia-Steuer
Jalapeño stellt einen strategischen Wendepunkt für Cloud-Anbieter dar. Während das Training immer noch auf schweres Gerät und GPU-Farmen angewiesen ist, wird der Inferenzlauf (wenn ein Modell tatsächlich Millionen von Anfragen beantwortet) durch dedizierte Chips billiger und optimiert. OpenAI nutzt hier ein tiefgreifendes Hardware-Software-Co-Design. Wenn es den Großteil des ChatGPT-Verkehrs auf sein eigenes Silizium verlagert, wird es Milliarden von Dollar an Margen sparen. Für Nvidia bedeutet dies Einnahmeverluste von einem Kunden, der das Markttempo diktiert.
Günstiger Betrieb als Notwendigkeit, nicht als Luxus
Da der Preis pro Token bei Modellen der dritten und vierten Generation sinkt (einschließlich der Ankündigung von Gemini 3.7 Flash durch Google), ist eine Hardware-Notbremse unerlässlich. Wer die billigste Inferenz-Pipeline anbietet, bindet Kunden, die lange und iterative agentenbasierte Workflows ausführen. Es bleibt die Frage, ob die erste Generation skalieren kann, ohne anfängliche Probleme bei der Kühlung oder Netzwerkverbindungen zu haben.
Wann werden wir die Auswirkungen auf die Preise sehen?
Der Beweis, dass Jalapeño unter Volllast wirklich funktioniert, werden nicht nur Pressemitteilungen sein. Es wird ein weiterer tiefer Einschnitt bei den API-Preisen Ende 2026 sein. Sobald OpenAI den Ausgabepreis pro Million Token flächendeckend unter das Niveau senkt, das herkömmliche H100- oder B200-Infrastrukturen mit angemessener Marge generieren können, hat Jalapeño gewonnen.
Liliths Urteil
Für Nvidia ist es nicht das Ende der Welt, aber ein Weckruf. Wer die Rechnung für Token bezahlt, baut schließlich seine eigene Kneipe.
Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.
Originalquelle ↗ ↗