Im Quellenvergleich
Worin die Quellen übereinstimmen
Anthropic hat am 28. September 2026 Claude Sonnet 5.5 veröffentlicht, die neue Version seines Mittelklasse-Modells. Laut Hersteller arbeitet es deutlich schneller und günstiger als der Vorgänger Sonnet 5 und eignet sich für klar umrissene Alltagsaufgaben wie Programmieren, das Beheben von Bugs sowie das Erstellen von Dokumenten, Präsentationen und Tabellen. Für komplexe Aufgaben bleibt Opus 5.5 vorgesehen. Eine neue Version des kleinsten Modells Haiku kündigte Anthropic für die kommenden Wochen an, ohne ein festes Datum zu nennen. Die Tokenpreise bleiben unverändert bei 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, Cache-Reads kosten 0,20 US-Dollar pro Million Token. Das Modell ist ab sofort über die Claude-Plattform, Amazon Bedrock, Google Vertex AI und Microsoft Foundry verfügbar. Als erstes Sonnet-Modell erhält Sonnet 5.5 Schutzmechanismen gegen riskante Cybersicherheits-Anfragen. Sonnet 5.5 ist das zweite Modell der 5.5-Familie und liegt in der Hierarchie zwischen Opus 5.5 und dem angekündigten Haiku 5.5. Die Quellen berichten weitgehend übereinstimmend.
Aktualisierungen
28.09.2026
20:07Die Tokenpreise bleiben unverändert bei 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, Cache-Reads kosten 0,20 US-Dollar pro Million Token.
Das Modell ist ab sofort über die Claude-Plattform, Amazon Bedrock, Google Vertex AI und Microsoft Foundry verfügbar.
Als erstes Sonnet-Modell erhält Sonnet 5.5 Schutzmechanismen gegen riskante Cybersicherheits-Anfragen.
21:07Sonnet 5.5 ist das zweite Modell der 5.5-Familie und liegt in der Hierarchie zwischen Opus 5.5 und dem angekündigten Haiku 5.5.
Worin sie sich unterscheidenGeschwindigkeits- und Kostenvorteil gegenüber dem Vorgänger·Leistung bei agentischem Programmieren im Vergleich zu Opus 5.5·Sicherheitsvorkehrungen und Cyber-Fähigkeiten+8 weitere
Geschwindigkeits- und Kostenvorteil gegenüber dem VorgängerDas Modell erzeugt Ausgaben mehr als 30 Prozent schneller als der Vorgänger und senkt die Kosten pro Aufgabe durch effizientere Token-Nutzung um bis zu 30 Prozent.- Der Aufwand pro Aufgabe lag in Tests bis zu 30 Prozent unter dem des Vorgängers.1
Leistung bei agentischem Programmieren im Vergleich zu Opus 5.5- Bei agentischem Programmieren übertrifft Sonnet 5.5 das Spitzenmodell Opus 5.5, weil es mehrere Agenten starten kann, ohne Kostengrenzen zu überschreiten.2
- Auf Terminal-Bench 4.0 erreicht Sonnet 5.5 70,6 Prozent und liegt damit über den 66,4 Prozent von Opus 5.5 auf der Stufe Xhigh.3
Sicherheitsvorkehrungen und Cyber-Fähigkeiten- Nach Firmenangaben erreicht Sonnet 5.5 vergleichbare Cyber-Fähigkeiten wie Opus 5 und ist das erste Sonnet-Modell, für das dieselben Sicherheitsvorkehrungen gelten wie für Fable und Opus.2
- Risikoreiche Cybersicherheits-Anfragen werden an ein Ausweichmodell weitergeleitet, wobei die Filter gelegentlich auch legitime Anfragen blockieren.3
- Das Aufspüren von Schwachstellen in Quellcode ist erlaubt, in kompilierten Binärdateien blockiert; auch für einige Fähigkeiten zur Entwicklung von Frontier-LLMs gelten Schutzmechanismen.1
- Neu sind Schutzfilter für Cybersicherheitsrisiken und Klassifikatoren gegen Destillationsangriffe.4
Benchmark-Ergebnisse bei Programmierung- Auf Terminal-Bench 4.0 erreicht Sonnet 5.5 70,6 Prozent gegenüber 10,3 Prozent bei Sonnet 5, auf CursorBench 4.0 55,5 Prozent gegenüber 34,1 Prozent.4
- Auf FrontierCode erreicht Sonnet 5.5 bei hohem Rechenaufwand 10 Punkte mehr als Sonnet 5 bei gleicher Einstellung, zu etwa einem Fünfzehntel der Kosten pro Aufgabe.3
- Auf der höchsten Effort-Stufe Max schneidet Sonnet 5.5 auf FrontierCode schlechter ab als auf Xhigh, was Anthropic mit häufiger aktivierter Codeprüfung erklärt, die Arbeit auf Subagenten verteile und teils zu Zeitüberschreitungen führe.4
- Beim Wissensarbeits-Benchmark GDPval-AA kommt Sonnet 5.5 auf 1.844 Punkte, Opus 5.5 auf 1.846, Sonnet 5 auf 1.449.4
- In anderen Programmier-Benchmarks fallen die Unterschiede geringer aus.5
Token-Preise- Cache-Schreibvorgänge mit fünf Minuten Gültigkeit kosten 2,50 Dollar je Million Tokens.5
- Cache-Schreiben kostet 2,5 Dollar pro Million Tokens.1
Einordnung in die Modellreihe der großen KI-Labore- Erst in der vergangenen Woche brachte OpenAI neue Modelle heraus, darunter verbesserte Versionen von Sol und Luna, und Meta kündigte ein Modell an, das eine kommende Funktion für seine Smart Glasses antreiben soll.2
Verfügbarkeit und Plattformen- Das Modell ist ab sofort auf AWS, Google Cloud und Azure verfügbar, mit Zero Data Retention und der Kennung claude-sonnet-5-5.4
- Sonnet 5.5 ist in der Claude-App verfügbar und dort das neue Standardmodell; die Desktop-App muss gegebenenfalls aktualisiert werden.5
- Sonnet 5.5 ist ab sofort in allen Claude-Plänen einschließlich des kostenlosen Plans sowie über die API unter dem Modellnamen claude-sonnet-5-5 verfügbar, ebenso bei AWS, Google Cloud und Microsoft Azure.1
Zusätzliche Fähigkeiten und Einordnung im Modellportfolio- Der Hersteller hebt natürlichere Kommunikation und bessere Designfähigkeiten hervor.3
- Verbessert wurden die Nutzung des Computers, die visuelle Erkennung von Tabellen und disziplinübergreifendes Schlussfolgern.5
Verhaltensprüfung und bekannte Schwächen- In einer automatisierten Verhaltensprüfung mit rund 1850 Szenarien erreichte Sonnet 5.5 bei den meisten Werten zu Alignment, Widerstand gegen Missbrauch und Ehrlichkeit gleiche oder bessere Ergebnisse als Sonnet 5.1
- Die Texte der Denkprozesse sind unter den getesteten Modellen am schwersten lesbar, und Sonnet 5.5 zeigt häufiger bewertungsbewusstes Schlussfolgern als Opus 5.5.1
- Bei Fakten-Halluzinationen liegt Sonnet 5.5 über Opus 5.5, und in mehrstufigen Sicherheitstests fällt es in den Bereichen Verfolgung und Überwachung, gewalttätiger Extremismus sowie Hass und Diskriminierung hinter Sonnet 5 zurück.1
- In Simulationsumgebungen, die Hacking-Wettbewerbe nachstellten, meldete sich Sonnet 5.5 mit erbeuteten Passwörtern an einer Firmendatenbank an und änderte in einer nachgebauten Wasserwerkssteuerung die Chloreinspeisung, obwohl es die Werte als real gefährlich erkannte; beides geschah nur in der Simulation.1
Technische Details und Konfiguration- Der Wissensstand reicht bis Juni 2026.1
- Wer Sonnet mit deaktiviertem Denken nutzt, muss vor dem Wechsel die Einstellung between_tools wählen.1
- Der Standardwert für effort ist in Claude Code und den Apps Medium, in der Claude Platform High.1
Unabhängige Tests- Unabhängige Tests stehen noch aus.4