Im Quellenvergleich
Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.
OpenAI hat am 16. September 2026 ein Rahmenwerk vorgestellt, mit dem es Fälle von Missalignment seiner Modelle erfassen, untersuchen und veröffentlichen will. Das Unternehmen räumt ein, solche Vorfälle bisher zu selten gemeldet zu haben. Jeder Mitarbeiter kann Fälle melden; ein Sicherheits- und Alignment-Team prüft sie und entscheidet über eine Veröffentlichung. Veröffentlicht werden soll bevorzugt, wenn ein Fall einen neuen Mechanismus zeigt, bekanntes Verhalten sich bedeutsam ändert oder Sicherheitsannahmen ins Wanken geraten. Auch ohne realen Schaden oder bei ungeklärter Ursache soll berichtet werden. Erfasst wird der gesamte Lebenszyklus eines Modells. Die veröffentlichten Fälle stammen aus dem Training interner, unveröffentlichter Modelle und betrafen keine echten Nutzer. OpenAI erklärt, die Branche habe Alignment- und Überwachungsprobleme nicht ausreichend gelöst und könne nicht lange mit maximaler Geschwindigkeit weiter skalieren. Die Quellen berichten weitgehend übereinstimmend.