Im Quellenvergleich
Worin die Quellen übereinstimmen
Anthropic hat Claude Opus 5 veröffentlicht. Das Modell ist für den täglichen Gebrauch gedacht und wird das neue Standardmodell auf Claude Max. Es kostet 5 Dollar pro Million Input-Tokens und 25 Dollar pro Million Output-Tokens. Opus 5 übertrifft laut Unternehmen auf den Benchmarks Frontier-Bench und GDPval-AA alle anderen Modelle. Bei Cybersicherheitsaufgaben bleibt es hinter Mythos 5 zurück. Die Quellen berichten weitgehend übereinstimmend.
Worin sie sich unterscheidenLeistungsvergleich mit Fable 5·Leistung auf Frontier-Bench v0.1·Sicherheitsvorkehrungen und Schutzmechanismen+4 weitere
Leistungsvergleich mit Fable 5- Das Modell komme der Intelligenz von Fable 5 nahe, koste aber nur halb so viel.1
- Es ist kleiner, günstiger und weniger restriktiv als Fable 5 und übertrifft dieses bei mehreren Benchmarks.2
- Das Modell bietet fast die Intelligenz von Fable 5 zu halben Kosten.3
Leistung auf Frontier-Bench v0.1- Opus 5 verdopple die Leistung des Vorgängers Opus 4.8 bei geringeren Kosten pro Aufgabe.1
- Opus 5 erreicht 43,3 Prozent, mehr als doppelt so viel wie Opus 4.8 mit 18,7 Prozent und deutlich vor Fable 5 mit 33,7 Prozent.3
Sicherheitsvorkehrungen und Schutzmechanismen- Das Modell unterliegt nicht der 30-tägigen Datenaufbewahrungsrichtlinie von Fable und Mythos. Es gibt dennoch Sicherheitsvorkehrungen, etwa gegen die Nutzung für bestimmte Cybersicherheitsaufgaben. Anthropic erwartet, dass diese Schutzmechanismen bei Opus 5 85 Prozent seltener auslösen als bei Fable 5.2
- Anthropic gibt an, Opus 5 sei sein ausgerichtetstes Modell mit der niedrigsten Rate an Fehlverhalten. Das Unternehmen habe bewusst auf Cyber-Training verzichtet, das Modell verbesserte sich dennoch. Bei Sicherheitsklassifikatoren fällt Claude auf Opus 4.8 zurück.3
Einführung der Beta-Funktion 'Automatic Fallbacks'- Anthropic führt eine Beta-Funktion namens 'Automatic Fallbacks' ein, die Anfragen bei Auslösung des Sicherheitsclassifiers automatisch an ein schwächeres Modell weiterleitet, sodass API-Nutzer eine funktionale Antwort statt einer Fehlermeldung erhalten.2
Einstellbarer 'Effort'-Modus- Das Modell verfügt über einen einstellbaren 'Effort'-Modus, der Geschwindigkeit und Token-Ersparnis gegen Intelligenz tauscht.3
Kundenberichte zu Tokens und Genauigkeit- Kunden wie Harvey und Zapier berichten von weniger Tokens und höherer Genauigkeit.3
Bewertung und Compute-Deal- Der Launch erfolgt bei einer Bewertung von rund 380 Milliarden Dollar und einem berichteten 30-Milliarden-Dollar-Azure-Compute-Deal.3