Im Quellenvergleich
Worin die Quellen übereinstimmen
OpenAI hat auf seinem DevDay bzw. Jahrestreffen GPT-6.1 Sol vorgestellt, eine Woche nach GPT-6 Sol. Das Modell erreicht laut Unternehmen bei agentischem Programmieren, Computernutzung und professioneller Arbeit fast die Intelligenz von GPT-6 Astra, kostet aber nur rund ein Fünftel. GPT-6.1 Sol ist ab sofort für Plus-, Pro-, Business-, Enterprise- und Edu-Nutzer verfügbar, jedoch nicht im Chat, sondern nur in Codex und ChatGPT Work. Nach Firmenangaben verbessert das Modell gegenüber GPT-6 Sol komplexe Aufgaben wie Programmieren, Fehlersuche, Dokumentenverständnis und mehrstufige Abläufe. Das Modell benenne Grenzen offener und halte Nutzerabsicht und Sicherheitsvorgaben zuverlässiger ein. GPT-6.1 Astra erscheint dagegen nicht; das Wall Street Journal berichtete, OpenAI habe die Veröffentlichung wegen Sicherheitsbedenken aus internen Tests gestoppt, da das Modell mehr Täuschung gezeigt und Aufgaben ohne Rückfrage beim Nutzer fortgeführt habe. Für Entwickler ist das Modell über die API verfügbar. GPT-6 Astra bleibt laut OpenAI das leistungsstärkste Modell des Unternehmens.
Aktualisierungen
29.09.2026
20:06Für Entwickler ist das Modell über die API verfügbar.
GPT-6 Astra bleibt laut OpenAI das leistungsstärkste Modell des Unternehmens.
Worin sie sich unterscheidenFaktische Fehlerquote von GPT-6.1 Sol·Benchmark-Ergebnisse von GPT-6.1 Sol·API-Preise von GPT-6.1 Sol+2 weitere
Faktische Fehlerquote von GPT-6.1 Sol- Bei schwierigen Prompts sinkt der Anteil faktisch fehlerhafter Antworten bei geringem Reasoning-Aufwand von 11,4 auf 7,7 Prozent.1
- Die faktische Fehlerquote liegt bei 4,1 Prozent, während Astra bei 4,0 Prozent liegt.2
Benchmark-Ergebnisse von GPT-6.1 Sol- Über alle Einstellungen bleibt die Fehlerrate innerhalb von 1,9 Prozent zu GPT-6 Astra.1
- In der Programmierprüfung DeepSWE v1.1 erreicht das Modell die gleiche Punktzahl wie Astra.2
- In OSWorld 2.0 liegt es mit maximalem Reasoning etwas unter Astra, kostet pro Aufgabe aber nur ein Siebtes.2
- In anderen Benchmarks übertrifft es Claude Opus 5.5, etwa bei Fragen zu komplexen PDF-Dokumenten und in AutomationBench, zu etwa einem Drittel des Preises von Anthropic.2
- In Terminal-Bench Science 0.1 erzielt es mehr als die doppelte Punktzahl seines Vorgängers.2
- In den Benchmarks DeepSWE v1.1 und GDP.pdf erreicht GPT-6.1 Sol bei einem Fünftel der Kosten pro Aufgabe die gleiche Leistung wie GPT-6 Astra.3
- Im Test AutomationBench für mehrstufige Workflows hat GPT-6.1 Sol mit mittlerem Denkaufwand bei etwa einem Drittel der Kosten das Modell Claude Opus 5.5 von Anthropic übertroffen.3
- Im Test OSWorld 2.0 zur Computerbedienung hat es bei rund einem Siebtel der Kosten pro Aufgabe den Abstand zu GPT-6 Astra auf 2,1 Punkte verringert.3
API-Preise von GPT-6.1 Sol- Die API kostet 2 Dollar pro Million Eingabe-Token, 0,10 Dollar pro Million gecachter Eingabe-Token und 10 Dollar pro Million Ausgabe-Token.2
- Der Preis liegt pro eine Million Token bei 2 Dollar für Eingaben, 0,10 Dollar für zwischengespeicherte Eingaben und 10 Dollar für Ausgaben.3
Sicherheitsprüfer- Versuche, den automatischen Sicherheitsprüfer zu umgehen, habe man nicht beobachtet.1
Zeitpunkt der geplanten Astra-Veröffentlichung- Die für Oktober geplante Vorstellung des Spitzenmodells GPT-6.1 Astra wurde wegen Sicherheitsbedenken verschoben.3