OpenAI veröffentlichte am 25. August 2026 erste gemessene Leistungsergebnisse des Jalapeño, des ersten Custom-Inference-Chips des Unternehmens. Im InferenceX-Benchmark mit GPT-OSS 120B erreichte der Prozessor höheren Peak-Durchsatz pro Kilowatt als kommerzielle Vergleichssysteme und niedrigere Token-Latenz als Wettbewerber. Der Chip zeigte modellübergreifend stabile Performance auf DeepSeek R1 und Kimi K2.

Jalapeño ist nach Angaben von OpenAI ein „arbeitsfähiges First-Party-Silicon mit gemessenen Ergebnissen". Zukünftige Generationen des Prozessors befinden sich bereits in Entwicklung.

Strategische Zusammenarbeit mit Broadcom

OpenAI und Broadcom gaben am 24. Juni 2026 eine strategische Zusammenarbeit bekannt. Ziel ist die Bereitstellung von 10 Gigawatt OpenAI-designter KI-Beschleuniger. OpenAI entwirft die Beschleuniger und Systeme; Broadcom entwickelt und stellt sie bereit. Diese Arbeitsteilung ermöglicht es OpenAI, Erfahrungen aus der Entwicklung von Frontier-Modellen und Produkten direkt in die Hardware-Architektur einfließen zu lassen.

Full-Stack-Ansatz vom Rechenzentrum bis zum Endgerät

OpenAI verfolgt einen integrierten Full-Stack-Ansatz zur Bereitstellung von „abundanter Intelligenz". Das System umfasst Rechenzentren und Chips, Frontier-Modelle, die Entwicklerplattform, Consumer- und Enterprise-Produkte sowie KI-native Geräte. OpenAI entwickelt Modelle, Produkte, Serving-Software, Chips, Memory, Networking und Systeme gemeinsam.

Der Ansatz basiert auf der These, dass KI-Infrastruktur nicht aufgrund ihrer Größe wertvoll ist, sondern wegen dessen, was sie ermöglicht: fähigere Intelligenz für mehr Menschen zu niedrigeren Kosten. Erkenntnisse aus realen Workloads fließen zurück durch das System zur Verbesserung jeder Schicht.

Preisreduktionen für GPT-5.6-Modelle

OpenAI gab am 31. Juli 2026 Preisreduktionen für die GPT-5.6-Modellfamilie bekannt:

  • GPT-5.6 Luna: 80 Prozent Preisreduktion auf 0,20 US-Dollar pro Million Input-Token und 1,20 US-Dollar pro Million Output-Token
  • GPT-5.6 Terra: 20 Prozent Preisreduktion auf 2 US-Dollar und 12 US-Dollar pro Million Token
  • GPT-5.6 Sol Fast-Modus: Bis zu 2,5-fache Geschwindigkeitssteigerung bei doppeltem Preis ohne Intelligenzeinbußen

Diese Preisänderungen erweitern nach Angaben von OpenAI den Bereich praktischer Anwendungsszenarien und geben Kunden mehr Flexibilität beim Ausbalancieren von Intelligenz, Geschwindigkeit, Zuverlässigkeit und Kosten. Die Messgröße sollte die Gesamtkosten eines erfolgreichen Ergebnisses sein, einschließlich Zeit, Wiederholungen, Überwachung und Fehlern.

Diversifiziertes Hardware- und Provider-Portfolio

OpenAI verwaltet ein Portfolio unterschiedlicher Hardware- und Cloud-Anbieter. Microsoft Compute und NVIDIA-Chips bezeichnet das Unternehmen als grundlegend für das eigene Wachstum. Zusätzliche Partner sind AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy und SoftBank.

Jeder Partner bringt unterschiedliche Stärken in Cloud-Infrastruktur, beschleunigtes Computing, Low-Latency-Inference, Rechenzentrum-Entwicklung und Energiebereitstellung ein. OpenAI strebt eine Pareto-Frontier-Strategie an: Premium-Systeme wo Fähigkeiten entscheidend sind, Effizienzoptimierung wo Skalierung und Kosteneffizienz wichtiger sind.

Synergien zwischen Modellen und Hardware

Die Systemintegration zielt auf einen Kreislaufeffekt: Bessere Software macht Hardware produktiver. Für spezifische Workloads designte Hardware verbessert Geschwindigkeit und Effizienz. Fähigere Modelle ermöglichen bessere Produkte, die mehr Nachfrage, Nutzung und Lernmöglichkeiten generieren. Diese Signale fließen zurück durch das System.

GPT-5.6 Sol half nach Angaben von OpenAI, die Produktions-Software zur Modellbereitstellung zu optimieren und die End-to-End-Serving-Kosten zu reduzieren. Engineering-Arbeiten zeigen, wie jede Compute-Einheit produktiver wird.

Mission und wirtschaftliches Modell

Die Vision der „abundanten Intelligenz" ist sowohl in OpenAI's Mission verankert – sicherzustellen, dass künstliche allgemeine Intelligenz der gesamten Menschheit zugutekommt – als auch im wirtschaftlichen Motor des Geschäfts. Der Zyklus: Bessere Intelligenz treibt breitere Adoption, breitere Adoption unterstützt mehr Investitionen, mehr Investitionen verbessern Intelligenz und Effizienz.

Jalapeño ist Teil der langfristigen Full-Stack-Infrastruktur-Strategie von OpenAI, um Compute abundanter zu machen. Das Ziel ist schnellere, zuverlässigere und erschwinglichere KI, die Lösungen für wichtigere Probleme ermöglicht.