Im Quellenvergleich
Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.
Anthropic hat untersucht, welche Werte der KI-Assistent Claude in Gesprächen ausdrückt und wie diese je nach Modell und Sprache variieren. Die Forscher identifizierten aus anonymisierten Claude.ai-Gesprächen mehrere Wertvorstellungen und verdichteten sie auf vier Hauptachsen: Nachgiebigkeit vs. Vorsicht, Wärme vs. Genauigkeit/Strenge, Tiefe vs. Kürze und Offenheit vs. Ausführung/Gefälligkeit. Die Werteprofile der Modelle entsprechen subjektiven Einschätzungen: Sonnet 4.6 gilt als wärmer, Opus 4.7 als genauer. Auch die Sprache beeinflusst die Werte. Claude drückt in Arabisch und Hindi mehr Wärme aus, in Englisch und Russisch mehr Genauigkeit. Die größten Unterschiede zwischen den Sprachen zeigten sich auf der Achse Wärme vs. Genauigkeit. Die Methode soll helfen, den Einfluss von Training und kulturellem Kontext auf Claudes Werte zu verstehen. Die vier Hauptachsen erklären rund 15 Prozent der Variation. Die Ursache der sprachabhängigen Unterschiede ist unklar; Anthropic vermutet Unterschiede in Menge und Zusammensetzung der Trainingsdaten pro Sprache. Das Unternehmen weiß noch nicht, ob es diese sprachabhängigen Unterschiede als gewünschte Anpassung oder als Fehler betrachtet.