Im Quellenvergleich
Worin die Quellen übereinstimmen
Anthropic hat Claude Sonnet 5 veröffentlicht. Das Modell ist ab sofort in allen Tarifen und über die API verfügbar. Laut Hersteller erreicht es fast die Leistung des teureren Opus 4.8 und übertrifft den Vorgänger Sonnet 4.6 in Bereichen wie Reasoning, Tool-Nutzung und Programmierung. Es kann selbstständig planen, Browser und Terminals nutzen. Der Einführungspreis bis zum 31. August 2026 beträgt 2 Dollar pro Million Input-Token und 10 Dollar pro Million Output-Token; danach steigt er auf 3 bzw. 15 Dollar. In den Claude-Apps ist Sonnet 5 die Standardoption, auch für Gratisnutzer. Das Modell halluziniert seltener als der Vorgänger und wehrt bösartige Anfragen besser ab. In Benchmarks zum agentischen Programmieren erreicht Sonnet 5 63,2 Prozent im SWE-bench Pro, Sonnet 4.6 lag bei 58,1 Prozent, Opus 4.8 bei 69,2 Prozent. Im Terminal-Bench 2.1 erzielt Sonnet 5 80,4 Prozent, Sonnet 4.6 67 Prozent, Opus 4.8 82,7 Prozent. Bei der Nutzung von Werkzeugen (Computer Use) erreicht Sonnet 5 81,2 Prozent, Sonnet 4.6 78,5 Prozent, Opus 4.8 83,4 Prozent. Die Analysefirma Artificial Analysis bescheinigt Sonnet 5 im Intelligence Index 53 Punkte, mehr als dem Vorgänger (47) und knapp unter Opus 4.8 (56) und GPT-5.5 (55).
Aktualisierungen
06.07.2026
Das Modell halluziniert seltener als der Vorgänger und wehrt bösartige Anfragen besser ab.
In Benchmarks zum agentischen Programmieren erreicht Sonnet 5 63,2 Prozent im SWE-bench Pro, Sonnet 4.6 lag bei 58,1 Prozent, Opus 4.8 bei 69,2 Prozent.
Im Terminal-Bench 2.1 erzielt Sonnet 5 80,4 Prozent, Sonnet 4.6 67 Prozent, Opus 4.8 82,7 Prozent.
Bei der Nutzung von Werkzeugen (Computer Use) erreicht Sonnet 5 81,2 Prozent, Sonnet 4.6 78,5 Prozent, Opus 4.8 83,4 Prozent.
Die Analysefirma Artificial Analysis bescheinigt Sonnet 5 im Intelligence Index 53 Punkte, mehr als dem Vorgänger (47) und knapp unter Opus 4.8 (56) und GPT-5.5 (55).
Worin sie sich unterscheidenKosten pro Aufgabe im Vergleich·Einführungspreis als kostenneutraler Wechsel·Cybersicherheitsfähigkeiten+7 weitere
Kosten pro Aufgabe im Vergleich- Sonnet 5 benötigt pro Aufgabe etwa 40 Prozent mehr Ausgabe-Tokens als der Vorgänger, was die Kosten pro Aufgabe verdoppelt und sie sogar 15 Prozent über denen von Opus 4.8 liegen lässt.1
- Eine durchschnittliche Aufgabe mit Sonnet 5 kostet 2,29 Dollar, während dieselbe Aufgabe mit Opus 4.8 bei 1,97 Dollar liegt. Grund ist der massiv gestiegene Verbrauch: Sonnet 5 nutzt bei maximaler Leistung rund 40 Prozent mehr Output-Tokens pro Aufgabe als Sonnet 4.6.2
Einführungspreis als kostenneutraler Wechsel- Laut Anthropic ist der Einführungspreis darauf kalibriert, den Wechsel „etwa kostenneutral“ zu halten.3
- Sonnet 5 ist damit jedoch teurer als Opus 4.8.4
Cybersicherheitsfähigkeiten- Die Fähigkeit zu Cybersicherheitsaufgaben sei deutlich geringer als bei aktuellen Opus-Modellen.5
- Anthropic betont, das Modell sei nicht gezielt auf Cybersecurity-Aufgaben trainiert und schneide bei gefährlichen Cyber-Fähigkeiten deutlich schlechter ab als Opus 4.8 und Mythos 5.6
- Bei einer Prüfung zur Entwicklung von Exploits für den Firefox 147 scheiterte das Modell in allen Versuchen.7
Sicherheitsbewertung- Sicherheitstests zeigten laut Hersteller insgesamt weniger unerwünschtes Verhalten als bei Sonnet 4.6, etwa bei der Ablehnung bösartiger Anfragen und bei Halluzinationen.5
- Sonnet 5 zeigt weniger Halluzinationen als sein Vorgänger, aber etwas mehr Fehlverhalten als Opus 4.8.3
- Das Modell halluziniert seltener und weist schädliche Anfragen besser ab, bleibt aber hinter Opus 4.8 und Claude Mythos Preview bei der Sicherheit zurück.8
- Die Sicherheit habe sich verbessert, etwa bei der Abwehr bösartiger Anfragen. Allerdings sei die Erfolgsrate bei der Ausnutzung von Schwachstellen gestiegen, weshalb Anthropic die Blockierfunktion aktiviert.1
Wissensarbeit im Vergleich zu Opus 4.8- In einem Wissensarbeitstest übertrifft es Opus sogar.3
- Beim Wissensarbeit-Benchmark GDPval-AA v2 übertrifft Sonnet 5 Opus 4.8 knapp (1618 zu 1615).6
Technisches Detail zum Tokenizer- Sonnet 5 nutzt einen aktualisierten Tokenizer, der die gleiche Eingabe in 1,0 bis 1,35 mal so viele Tokens umwandeln kann.3
Unternehmenskontext und Börsengang- Das Unternehmen will so die Nutzung verbreitern, während es auf einen Börsengang zusteuert. Das Unternehmen meldete zuletzt einen Jahresumsatz von über 47 Milliarden Dollar bei einer Bewertung von 965 Milliarden Dollar.3
Berichte von Partnern- Frühe Partner wie Cursor und Zapier berichten, dass das Modell mehrstufige Aufgaben zuverlässig abschließt, die frühere Modelle abbrachen.3
Veröffentlichung von Claude Science- Anthropic veröffentlichte zudem Claude Science, ein Werkzeug für die Forschung.9
Aufhebung von Exportkontrollbeschränkungen- Parallel hob die US-Regierung die Exportkontrollbeschränkungen für die Modelle Mythos und Fable auf. Die Zugänge sollten ab Mittwoch wiederhergestellt werden.9
- Die US-Regierung habe die Freigabe für die leistungsstärkeren Modelle Fable 5 und Mythos 5 erteilt, die ab sofort wieder genutzt werden könnten.4
Früher genannt, aktuell nicht mehr getragen (4)
Benchmark-Ergebnisse im agentischen Programmieren (SWE-bench Pro)Im Codierungstest SWE-bench Pro erreicht Sonnet 5 63,2 Prozent, Sonnet 4.6 58,1 Prozent und Opus 4.8 69,2 Prozent.310- In einem Benchmark erreicht es 63,2 Prozent bei agentischem Programmieren (Opus 4.8: 69,2 Prozent).8
- Im SWE-bench Pro stieg die Trefferquote von 58,1 auf 63,2 Prozent.7
— von den aktuellen Quellen nicht mehr getragen (zuerst 30.06.2026) Preisvergleich mit anderen Modellen- Es ist günstiger als Opus 4.8, GPT-5.5 und Gemini 3.1 Pro, aber teurer als Gemini 3.5 Flash.8
— von den aktuellen Quellen nicht mehr getragen (zuerst 30.06.2026) Standard für Free- und Pro-Nutzer- Das Modell ist ab sofort der Standard für Free- und Pro-Nutzer.3
- Der Sonnet 5 ist für Nutzer der App oder Website kostenlos.7
— von den aktuellen Quellen nicht mehr getragen (zuerst 30.06.2026) Weitere Benchmark-Ergebnisse (Terminal-Bench, Computer Use)- Im Terminal-Bench 2.1 erreichte Sonnet 5 80,4 Prozent, Sonnet 4.6 67 Prozent, Opus 4.8 82,7 Prozent.10
- Bei der Nutzung von Werkzeugen (Computer Use) erreichte Sonnet 5 eine Erfolgsrate von 81,2 Prozent, Sonnet 4.6 78,5 Prozent, Opus 4.8 83,4 Prozent.10
- Im Terminal-Bench 2.1 stieg die Trefferquote von 67 auf 80,4 Prozent.7
— von den aktuellen Quellen nicht mehr getragen (zuerst 30.06.2026)