Im Quellenvergleich
Worin die Quellen übereinstimmen
Tavus hat ein KI-Modell namens Griffin vorgestellt, das Videogespräche in Echtzeit führt und dabei Sprache, Mimik, Tonfall, Gesten und Pausen verarbeitet. Eine Vorabversion namens Griffin-Lite ist für ausgewählte Tester verfügbar. In einem einminütigen Videogespräch hielten 48 Prozent der Teilnehmer Griffin für einen Menschen. Tavus bezeichnet Griffin-Lite als erstes Modell, das einen Video-Turing-Test in Echtzeit besteht; die Prüfung und ihre Ergebnisse stammen von Tavus selbst. Griffin-Lite arbeitet full-duplex: Es hört und beobachtet während der Generierung von Stimme und Video weiter und bewertet das Gespräch in Abständen unter einer Sekunde. NVIDIA führt Griffin-Lite in VideoFDB, einem Benchmark aus 237 Videocall-Ausschnitten und 11 Gesprächsdynamiken. Dort erreicht es 3,83 Punkte in der Generierung gegenüber 3,92 beim menschlichen Referenzwert. NVIDIA betont, die Systeme blieben bei natürlicher Gesprächsführung unter dem menschlichen Referenzwert. Tavus arbeitet an Warnfunktionen und verlangt ausdrückliches Einverständnis für Nachbildungen von Bild oder Stimme. In der EU müssen Systeme, die direkt mit Menschen interagieren, seit dem 2. August 2026 darauf hinweisen, dass eine KI im Gespräch ist, außer wenn dies offensichtlich ist. Die Quellen berichten weitgehend übereinstimmend.
Worin sie sich unterscheidenVergleichswert früherer Systeme·NVIDIA-Test zur menschlichen Wirkung·Einordnung des Turing-Tests+2 weitere
Vergleichswert früherer Systeme- Bisherige Systeme erreichten höchstens zwei Prozent.1
- In einer vergleichbaren früheren Prüfung mit dem Vorgängersystem der Firma hielt nur 1 von 41 Teilnehmern den Gesprächspartner für einen Menschen.2
NVIDIA-Test zur menschlichen Wirkung- In einem laut Tavus unabhängigen Nvidia-Test zur menschlichen Wirkung im direkten Gespräch erzielte Griffin 3,83 Punkte, Menschen kamen auf 3,92 und das zuvor beste KI-Modell auf 2,80 Punkte.1
- NVIDIA führt Griffin-Lite in VideoFDB und dort führt es die Tabellen zur Wahrnehmung mit 3,73 gegenüber 4,20 beim menschlichen Referenzwert und zur Generierung mit 3,83 gegenüber 3,92 an.2
Einordnung des Turing-Tests- Alan Turings Test von 1950 war rein schriftlich, ein einheitliches Video-Turing-Test-Protokoll gibt es nicht.2
- Ein PNAS-Studium von Mai 2026 mit schriftlichen Fünf-Minuten-Gesprächen nennt andere Werte: GPT-4.5 wurde mit zusätzlichen Instruktionen für eine menschliche Persönlichkeit in 73 Prozent der Fälle für den Menschen gehalten, ohne diese Instruktionen in 36 Prozent.2
Zukünftige Version und Anwendungen- Eine leistungsfähigere Version soll folgen, und als mögliche Anwendungen nennt Tavus Nachhilfe, das Üben schwieriger Gespräche und technische Hilfe per Kamera.1
Unternehmenshintergrund- Das KI-Startup aus San Francisco wurde laut eigenen Angaben 2020 gegründet und hat rund 64 Millionen US-Dollar eingesammelt; es entwickelte zunächst personalisierte KI-Videos für Vertrieb und Marketing, später auch Technik für direkte Videogespräche mit digitalen Personen.1