Im Quellenvergleich

Google Gemini 3.8 Live

2 Quellen · 2 Meldungen · Stand 15.09.2026

Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.

Im Quellenvergleich

Worin die Quellen übereinstimmen

Google hat am 15. September 2026 zwei Audio-Modelle vorgestellt: Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking. Beide verarbeiten Spracheingaben nahezu in Echtzeit, laufen über die Gemini API und Google AI Studio und unterstützen über 97 Sprachen. Gemini 3.8 Live führt Werkzeug- und API-Aufrufe im Hintergrund aus, während das Gespräch weiterläuft, und verarbeitet visuelle Eingaben nahezu in Echtzeit. Die Variante Extended Thinking ist für komplexe Aufgaben gedacht und denkt und spricht gleichzeitig. Nach Google-Angaben erreicht Extended Thinking Platz 1 im Speech-to-Speech-Leaderboard von Artificial Analysis mit 82,6 Prozent. Beispiel-Apps stehen auf GitHub bereit. Die Quellen berichten weitgehend übereinstimmend.

Worin sie sich unterscheidenPreisgestaltung und Kostenvergleich·Verfügbarkeit und Vertriebskanäle·Leistungsbenchmarks+2 weitere
Preisgestaltung und Kostenvergleich
  • Google verlangt 0,005 Dollar pro Minute für Audio-Eingabe und 0,018 Dollar für Audio-Ausgabe.1
  • Eine Stunde Sprachkonversation kostet bei Google rund 1,38 Dollar, bei OpenAI mindestens 3,00 Dollar.1
  • Google ist damit deutlich günstiger als OpenAIs kürzlich vorgestelltes GPT-Live-1 mit 0,05 Dollar pro Minute.1
  • Das OpenAI-Modell dürfte dank Full Duplex, also gleichzeitigem Zuhören und Sprechen, eine natürlichere Gesprächsführung bieten.1
Verfügbarkeit und Vertriebskanäle
  • Beide Modelle starten ab heute für Entwickler in der Gemini API und Google AI Studio, für Unternehmen in privater Vorschau in Gemini Enterprise.2
  • Gemini 3.8 Live erscheint zudem in Search Live, Extended Thinking in Gemini Live sowie für Abonnenten in Workspace, Gmail und Keep.2
Leistungsbenchmarks
  • Extended Thinking erreicht 68,6 Prozent bei τ-Voice und 35,1 Prozent bei Sierra's τ-Voice-banking.2
  • Beim Big Bench Audio kommt Extended Thinking auf 97,7 Prozent.2
  • Gemini 3.8 Live belegt laut Google den zweiten Platz in der Speech Agent Arena.2
Ökosystem und Partnerschaften
  • Entwicklerplattformen wie Agora, LangChain, LiveKit und Vercel nutzen die Gemini Live API, um sprachgesteuerte Schnittstellen zu bauen.2
  • Google nennt zudem Partnerschaften mit Salesforce, Genspark und Lumeris.2
Wasserzeichen für Audiodaten
  • Alle erzeugten Audiodaten versieht Google mit dem nicht wahrnehmbaren Wasserzeichen SynthID, damit KI-Inhalte erkennbar bleiben.2

Quellen (2)

Vollständige Übersicht mit allen Meldungen öffnen →