LIVE
+++ Skill-Paket für Webromane: 13 Skills, 7 Agenten +++ US-Jobmarkt: 34.000 Stellen weniger in IT und Finanzen +++ USA wollen KI-Sicherheit beim Trump-Xi-Gipfel ansprechen +++ OpenAI startet KI-Programm für ukrainische Redaktionen +++ Südkorea bündelt fünf Stromkonzerne für KI-Strombedarf +++ Rund 30 Roboter demonstrieren in Warschau für KI-Regeln ++++++ Skill-Paket für Webromane: 13 Skills, 7 Agenten +++ US-Jobmarkt: 34.000 Stellen weniger in IT und Finanzen +++ USA wollen KI-Sicherheit beim Trump-Xi-Gipfel ansprechen +++ OpenAI startet KI-Programm für ukrainische Redaktionen +++ Südkorea bündelt fünf Stromkonzerne für KI-Strombedarf +++ Rund 30 Roboter demonstrieren in Warschau für KI-Regeln +++
Alle News ›
AI IN LIFE AI IN LIFENEWS
DAILY
DE EN
Modelle

OpenAI startet Ultrafast: GPT-5.6 Sol bis zu 14-mal schneller

OpenAI führt mit „Ultrafast“ eine neue API-Stufe ein: GPT-5.6 Sol liefert bis zu 750 Tokens pro Sekunde — beschleunigt durch Cerebras-Hardware.

OpenAI startet Ultrafast: GPT-5.6 Sol bis zu 14-mal schneller

Symbolbild · KI-generiert (AI IN LIFE)

OpenAI hat am 14.

Auf einen Blick

  • Bis zu 750 Output-Tokens pro Sekunde im Ultrafast-Modus
  • Rund 14-fache Geschwindigkeit gegenüber dem Standardbetrieb
  • Basis ist die Cerebras-Partnerschaft im Volumen von 10 Mrd. Dollar
  • Drei API-Stufen: Standard, Fast und Ultrafast
  • Start als Preview für ausgewählte API-Kunden

OpenAI hat am 14. August eine neue Geschwindigkeitsstufe für seine API vorgestellt. Der Modus „Ultrafast“ lässt das Flaggschiffmodell GPT-5.6 Sol bis zu 750 Output-Tokens pro Sekunde erzeugen — laut OpenAI rund 14-mal schneller als der Standardbetrieb. Die Beschleunigung basiert auf Spezial-Hardware von Cerebras, mit dem OpenAI Anfang 2026 eine Partnerschaft im Volumen von zehn Milliarden Dollar geschlossen hat.

Mit dem Schritt etabliert OpenAI ein dreistufiges System aus Standard, Fast und Ultrafast. Geschwindigkeit wird damit — ähnlich wie bei Cloud-Anbietern — zu einem eigenen Preishebel: Wer Antworten in Echtzeit braucht, zahlt für die schnellere Auslieferung, während Batch- und Hintergrund-Workloads günstiger bleiben.

Parallel senkt OpenAI die API-Preise für die GPT-5.6-Reihe spürbar. Beobachter werten das als Reaktion auf den wachsenden Preisdruck durch chinesische Anbieter, die vergleichbare Leistung teils deutlich günstiger anbieten — auch wenn DeepSeek zeitgleich seine Preise anhebt.

Ultrafast ist zunächst als Preview über die API verfügbar und auf ausgewählte Kunden beschränkt; Interessenten können sich über ein Formular anmelden. Als Einsatzfelder nennt OpenAI unter anderem Echtzeit-Incident-Response, Finanzanalysen, Kundensupport, E-Commerce und interaktive Recherche-Workflows.

Für Anwender in Europa ist vor allem die Kombination interessant: sinkende Grundpreise plus eine kostenpflichtige Turbo-Stufe. Agentische Anwendungen, die viele Modellaufrufe verketten, profitieren überproportional von höherer Token-Geschwindigkeit — genau dort positioniert sich OpenAI gegen Google und Anthropic.

◈ KI-GENERIERTER BERICHT · QUELLEN VERLINKT

Häufige Fragen

Was ist OpenAI Ultrafast?

Eine neue API-Stufe, in der GPT-5.6 Sol auf Cerebras-Hardware läuft und bis zu 750 Tokens pro Sekunde ausgibt — etwa 14-mal schneller als der Standardmodus.

Wer kann Ultrafast nutzen?

Zunächst ausgewählte API-Kunden im Rahmen einer Preview; weitere Kapazität soll schrittweise folgen. Die Anmeldung läuft über ein Interessenformular bei OpenAI.

Warum senkt OpenAI gleichzeitig die Preise?

Der Konzern reagiert auf Preisdruck durch günstigere Konkurrenz, vor allem aus China, und macht Geschwindigkeit stattdessen zum kostenpflichtigen Premium-Merkmal.