Im Quellenvergleich
Worin die Quellen übereinstimmen
Das Startup Abliteration.ai vermietet Zugang zu KI-Modellen, denen Sicherheitsvorkehrungen entfernt wurden. Die Plattform hostet veränderte Versionen offener Modelle, darunter Z.ais GLM-5.3, und bietet sie im Browser oder per API an. Das Unternehmen vermarktet den Dienst für offensive Cybersicherheit, Red Teaming und Malware-Analysen. TechCrunch konnte mit dem Dienst ein Programm erstellen lassen, das gespeicherte Chrome-Passwörter stiehlt, sowie eine Anleitung zur Kultivierung eines gefährlichen Krankheitserregers. Eine Identitätsprüfung der Kunden gibt es nicht. Die Quellen berichten weitgehend übereinstimmend.
Worin sie sich unterscheidenZeitpunkt der Vorstellung der modifizierten GLM-5.3-Version·Technisches Verfahren zur Entfernung der Sicherheitsvorkehrungen·Auswirkungen auf die Fähigkeiten der Modelle+6 weitere
Zeitpunkt der Vorstellung der modifizierten GLM-5.3-Version- Die Plattform hostet veränderte Versionen offener Modelle, denen die Weigerung entfernt wurde, schädliche Aufgaben auszuführen.1
- Ende August stellte das Unternehmen eine modifizierte Version von Z.AIs GLM-5.3 vor, die sicherheitsrelevante Anfragen seltener verweigern soll.2
Technisches Verfahren zur Entfernung der Sicherheitsvorkehrungen- Die Plattform hostet veränderte Versionen offener Modelle, denen die Weigerung entfernt wurde, schädliche Aufgaben auszuführen.1
- Das Verfahren namens Abliteration verändert die Gewichte des Modells, statt per Prompt-Jailbreak zu arbeiten.2
Auswirkungen auf die Fähigkeiten der Modelle- Andere Experten bezweifeln den Nutzen: Abliteration verringere die Fähigkeiten der Modelle, und Jailbreaks seien bei offenen Modellen ohnehin leicht möglich.1
Preisgestaltung des Dienstes- TechCrunch konnte mit dem Dienst kostenlos ein Programm erstellen lassen, das gespeicherte Chrome-Passwörter stiehlt.1
- Das Modell kostet regulär fünf US-Dollar je eine Million Input- beziehungsweise Output-Token.2
Speicherung von Prompts und Antworten- Prompts und Antworten werden laut Anbieter nicht gespeichert.2
Eigene Schutzmechanismen und Verantwortung- Abliteration.ai bietet Kunden eine Moderationsschicht an. Eigene Schutzmechanismen sind minimal, etwa gegen Suizidanleitungen.1
- Mitgründer Devon sagt, man arbeite noch an der Frage der Verantwortung.1
Kritik und Forderungen an Anbieter- Kritiker wie Andrew Yoon von der KI-Sicherheitsorganisation CivAI warnen, dass solche Modelle zu 'Soziopathen' gemacht werden könnten. Er erwartet baldigen Missbrauch.1
- Yoon fordert, dass Anbieter Klassifikatoren einsetzen und GPU-Zugänge strenger kontrollieren.1
Befürwortung des Dienstes- Befürworter argumentieren, die Modelle halfen Verteidigern, Angreifer nachzuahmen. Kunden seien unter anderem Red-Teaming-Startups für Banken.1
Evaluationsergebnisse des Anbieters- In eigenen Evaluationen erreicht die abliterierte Version 84,5 Prozent auf CyberGym, 41,8 Prozent auf Terminal-Bench 4.0 und 105 gelöste ExploitGym-Aufgaben in zwei Stunden.2
- Der Anbieter weist darauf hin, dass die Vergleichswerte nur eingeschränkt vergleichbar sind.2