Im Quellenvergleich

Claude bei Anthropic-Entwicklung

2 Quellen · 2 Meldungen · Stand 18.09.2026

Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.

Im Quellenvergleich

Worin die Quellen übereinstimmen

Anthropic berichtet, dass sein KI-Modell Claude im August 26 Prozent der eigenen Forschungs- und Entwicklungsarbeit weitgehend selbstständig erledigt hat; im Februar lag dieser Wert noch unter einem Prozent. Die Bewertung erfolgt mit der sechsstufigen Skala AL0 bis AL5 des US-Instituts Epoch AI, wobei AL3 enge Zusammenarbeit mit einem Menschen und AL4 selbstständige Erledigung einer Aufgabe anhand eines übergeordneten Auftrags bezeichnet. Über 90 Prozent der untersuchten F&E-Arbeit erreichen mindestens AL3, 26 Prozent entfallen auf AL4. Die höchste Stufe AL5, vollständig autonome Arbeit, erreicht keine Aufgabe. Grundlage sind rund 15.000 F&E-Aufgaben aus einer Stichprobe im Juli 2026, die nach Tätigkeitsart kategorisiert und nach menschlichem Zeitaufwand gewichtet wurden. Auf der meistgenutzten internen Agenten-Plattform waren im August zeitweise rund 30.000 F&E-Agenten gleichzeitig aktiv; deren Aktionen werden vor der Ausführung automatisch kontrolliert. Bei mehr als einer Milliarde überprüften Entscheidungen blockierte das System einen sehr kleinen Teil. In einer Stichprobenwoche im Juli flossen rund 6 Prozent der für KI-F&E eingesetzten Rechenleistung in Sicherheitsaufgaben. Anthropic bezeichnet den Index selbst als Prototyp, hält eine unabhängige Überprüfung für sinnvoll und will die Kennzahlen künftig regelmäßig veröffentlichen. Die Quellen berichten weitgehend übereinstimmend.

Worin sie sich unterscheidenAnteil der blockierten Entscheidungen des Überwachungssystems·Anteil der Rechenleistung für Sicherheitsaufgaben bei KI-gestützter KI-F&E·Bezugsgröße der 26 Prozent+2 weitere
Anteil der blockierten Entscheidungen des Überwachungssystems
  • Das Überwachungssystem stoppte 0,002 Prozent der überprüften Entscheidungen.1
  • Bei mehr als einer Milliarde überprüften Entscheidungen blockierte das System etwa eine von 47.000.2
Anteil der Rechenleistung für Sicherheitsaufgaben bei KI-gestützter KI-F&E
  • In der Woche vom 13. bis 20. Juli flossen nach konservativer Schätzung etwa 6 Prozent der Rechenressourcen für Forschung und Entwicklung in die Sicherheit.1
  • Bei KI-gestützter KI-F&E flossen rund 12 Prozent der eingesetzten Rechenleistung in Sicherheitsaufgaben.2
Bezugsgröße der 26 Prozent
  • Die 26 Prozent beziehen sich auf den gewichteten Arbeitskorb, nicht auf alle erfassten Aufgaben.2
Frühere Kennzahl zur Codebasis
  • Bereits im Juni berichtete das Unternehmen, dass im Mai mehr als 80 Prozent der in die Produktions-Codebasis aufgenommenen Codezeilen Claude zugeschrieben wurden.2
Warnung des Unternehmenschefs
  • Anthropic-Chef Dario Amodei forderte kürzlich, das Tempo zu drosseln, und warnte vor einem möglichen Kontrollverlust über zunehmend autonome Systeme.2

Quellen (2)

Vollständige Übersicht mit allen Meldungen öffnen →