OpenAI startet Ultrafast: GPT-5.6 Sol bis zu 14-mal schneller
OpenAI führt mit „Ultrafast“ eine neue API-Stufe ein: GPT-5.6 Sol liefert bis zu 750 Tokens pro Sekunde — beschleunigt durch Cerebras-Hardware.
Symbolbild · KI-generiert (AI IN LIFE)
OpenAI hat am 14.
Auf einen Blick
- Bis zu 750 Output-Tokens pro Sekunde im Ultrafast-Modus
- Rund 14-fache Geschwindigkeit gegenüber dem Standardbetrieb
- Basis ist die Cerebras-Partnerschaft im Volumen von 10 Mrd. Dollar
- Drei API-Stufen: Standard, Fast und Ultrafast
- Start als Preview für ausgewählte API-Kunden
OpenAI hat am 14. August eine neue Geschwindigkeitsstufe für seine API vorgestellt. Der Modus „Ultrafast“ lässt das Flaggschiffmodell GPT-5.6 Sol bis zu 750 Output-Tokens pro Sekunde erzeugen — laut OpenAI rund 14-mal schneller als der Standardbetrieb. Die Beschleunigung basiert auf Spezial-Hardware von Cerebras, mit dem OpenAI Anfang 2026 eine Partnerschaft im Volumen von zehn Milliarden Dollar geschlossen hat.
Mit dem Schritt etabliert OpenAI ein dreistufiges System aus Standard, Fast und Ultrafast. Geschwindigkeit wird damit — ähnlich wie bei Cloud-Anbietern — zu einem eigenen Preishebel: Wer Antworten in Echtzeit braucht, zahlt für die schnellere Auslieferung, während Batch- und Hintergrund-Workloads günstiger bleiben.
Parallel senkt OpenAI die API-Preise für die GPT-5.6-Reihe spürbar. Beobachter werten das als Reaktion auf den wachsenden Preisdruck durch chinesische Anbieter, die vergleichbare Leistung teils deutlich günstiger anbieten — auch wenn DeepSeek zeitgleich seine Preise anhebt.
Ultrafast ist zunächst als Preview über die API verfügbar und auf ausgewählte Kunden beschränkt; Interessenten können sich über ein Formular anmelden. Als Einsatzfelder nennt OpenAI unter anderem Echtzeit-Incident-Response, Finanzanalysen, Kundensupport, E-Commerce und interaktive Recherche-Workflows.
Für Anwender in Europa ist vor allem die Kombination interessant: sinkende Grundpreise plus eine kostenpflichtige Turbo-Stufe. Agentische Anwendungen, die viele Modellaufrufe verketten, profitieren überproportional von höherer Token-Geschwindigkeit — genau dort positioniert sich OpenAI gegen Google und Anthropic.
Häufige Fragen
Was ist OpenAI Ultrafast?
Eine neue API-Stufe, in der GPT-5.6 Sol auf Cerebras-Hardware läuft und bis zu 750 Tokens pro Sekunde ausgibt — etwa 14-mal schneller als der Standardmodus.
Wer kann Ultrafast nutzen?
Zunächst ausgewählte API-Kunden im Rahmen einer Preview; weitere Kapazität soll schrittweise folgen. Die Anmeldung läuft über ein Interessenformular bei OpenAI.
Warum senkt OpenAI gleichzeitig die Preise?
Der Konzern reagiert auf Preisdruck durch günstigere Konkurrenz, vor allem aus China, und macht Geschwindigkeit stattdessen zum kostenpflichtigen Premium-Merkmal.