Im Quellenvergleich
Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.
Anthropic berichtet, dass sein KI-Modell Claude im August 26 Prozent der eigenen Forschungs- und Entwicklungsarbeit weitgehend selbstständig erledigt hat; im Februar lag dieser Wert noch unter einem Prozent. Die Bewertung erfolgt mit der sechsstufigen Skala AL0 bis AL5 des US-Instituts Epoch AI, wobei AL3 enge Zusammenarbeit mit einem Menschen und AL4 selbstständige Erledigung einer Aufgabe anhand eines übergeordneten Auftrags bezeichnet. Über 90 Prozent der untersuchten F&E-Arbeit erreichen mindestens AL3, 26 Prozent entfallen auf AL4. Die höchste Stufe AL5, vollständig autonome Arbeit, erreicht keine Aufgabe. Grundlage sind rund 15.000 F&E-Aufgaben aus einer Stichprobe im Juli 2026, die nach Tätigkeitsart kategorisiert und nach menschlichem Zeitaufwand gewichtet wurden. Auf der meistgenutzten internen Agenten-Plattform waren im August zeitweise rund 30.000 F&E-Agenten gleichzeitig aktiv; deren Aktionen werden vor der Ausführung automatisch kontrolliert. Bei mehr als einer Milliarde überprüften Entscheidungen blockierte das System einen sehr kleinen Teil. In einer Stichprobenwoche im Juli flossen rund 6 Prozent der für KI-F&E eingesetzten Rechenleistung in Sicherheitsaufgaben. Anthropic bezeichnet den Index selbst als Prototyp, hält eine unabhängige Überprüfung für sinnvoll und will die Kennzahlen künftig regelmäßig veröffentlichen. Die Quellen berichten weitgehend übereinstimmend.