Im Quellenvergleich
Worin die Quellen übereinstimmen
OpenAI hat einen neuen Modus namens „Ultrafast“ für sein Modell GPT-5.6 Sol vorgestellt. Laut Unternehmen arbeitet der Modus mit der 14-fachen Geschwindigkeit der Standardverarbeitung und erzeugt bis zu 750 Ausgabe-Tokens pro Sekunde. Möglich macht das eine Zusammenarbeit mit dem Chip-Hersteller Cerebras. Der Modus eignet sich laut OpenAI für Unternehmensabläufe wie Incident Response, Kundenservice, Finanzmarktanalyse und E-Commerce. Ultrafast erscheint zunächst als Vorschau und steht nur wenigen Kunden zur Verfügung. OpenAI will den Zugang ausweiten, sobald die Kapazitäten wachsen. Die schnelle Antwortzeit geht laut OpenAI nicht zulasten der Denkfähigkeit des Modells. Auch intern nutzt OpenAI die Funktion, etwa in der Forschung, um Experimente schneller auszuwerten. Die Vorschau startet über die OpenAI-API für ausgewählte Kunden. OpenAI monetarisiert Geschwindigkeit in Stufen: Der bestehende „Fast Mode“ verspricht bis zu 2,5-fach höhere Geschwindigkeit bei etwa doppelt so hohen Preisen; Ultrafast ist die dritte Stufe.
Aktualisierungen
14.08.2026
08:06Die schnelle Antwortzeit geht laut OpenAI nicht zulasten der Denkfähigkeit des Modells.
15:07Die Vorschau startet über die OpenAI-API für ausgewählte Kunden.
OpenAI monetarisiert Geschwindigkeit in Stufen: Der bestehende „Fast Mode“ verspricht bis zu 2,5-fach höhere Geschwindigkeit bei etwa doppelt so hohen Preisen; Ultrafast ist die dritte Stufe.
Worin sie sich unterscheidenPreis von Ultrafast·Vergleich mit Konkurrenzmodellen·Benchmark-Ergebnis+2 weitere
Preis von Ultrafast- Ultrafast ist die dritte Preisstufe, die deutlich schneller und wahrscheinlich teurer sein soll als der Fast Mode.1
Vergleich mit Konkurrenzmodellen- Konkurrenten wie Anthropic bieten beschleunigte Modellversionen an, etwa den schnellen Modus von Claude, der aber nicht die gleiche Geschwindigkeit erreicht.2
- Die Generierungsrate von 750 Token pro Sekunde sei elfmal schneller als Anthropics „Claude Fable 5“, gemessen an Berichten von Artificial Analysis.3
Benchmark-Ergebnis- Beim Benchmark „Humanity's Last Exam“ erreichte GPT-5.6 Sol laut Cerebras dieselbe Genauigkeit wie Fable 5 in 78 Stunden 27 Minuten, benötigte dafür aber nur 11 Stunden 11 Minuten.3
Technische Umsetzung- Die Beschleunigung stammt von Cerebras, mit dem OpenAI Anfang des Jahres eine Zehn-Milliarden-Zusammenarbeit einging.1
- Möglich macht das ein Chip, der eine ganze Siliziumwafer nutzt und 44 GB SRAM enthält; dadurch bleiben die Modellgewichte auf dem Chip, was Datenengpässe vermeidet.3
Anwendungsbereiche- Cerebras sieht den Modus für zeitkritische Aufgaben wie Fehlersuche oder Cyberabwehr.3
- Als Anwendungsfälle nennt der Artikel Incident Response, Finanzanalyse, Kundensupport und Forschung; OpenAI nutzt den Modus nach eigenen Angaben intern bereits für die Incident Response.1