Im Quellenvergleich

Gemma 4 12B Modell vorgestellt

5 Quellen · 5 Meldungen · Stand 06.07.2026

Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.

Im Quellenvergleich

Worin die Quellen übereinstimmen

Google hat das offene KI-Modell Gemma 4 12B veröffentlicht. Es verarbeitet Text, Bilder und Audio und läuft laut Unternehmen auf handelsüblichen Notebooks mit 16 Gigabyte Arbeitsspeicher. Das Modell ist unter der Apache-2.0-Lizenz veröffentlicht und über Hugging Face herunterladbar. Das Modell hat zwölf Milliarden Parameter. Es ist das erste mittelgroße Gemma-Modell mit nativer Audioverarbeitung. Das Modell verzichtet auf separate Encoder für Bild und Audio und verarbeitet den Input direkt im Sprachmodell.

Aktualisierungen
06.07.2026
Das Modell hat zwölf Milliarden Parameter.
Es ist das erste mittelgroße Gemma-Modell mit nativer Audioverarbeitung.
Das Modell verzichtet auf separate Encoder für Bild und Audio und verarbeitet den Input direkt im Sprachmodell.
Worin sie sich unterscheidenArt der Audio- und Bildverarbeitung·Leistungsvergleich mit dem 26B-Modell·Verfügbarkeit über zusätzliche Plattformen+3 weitere
Art der Audio- und Bildverarbeitung
  • Das Modell nutzt für Bilder ein leichtes Einbettungsmodul und projiziert Audiosignale direkt in den Text-Token-Raum.1
Leistungsvergleich mit dem 26B-ModellDas 12B-Modell erreicht fast die Werte des 26B-Modells.
  • Im GPQA Diamond erzielt es 78,8 Prozent (26B: 82,3 Prozent), im MMLU Pro 77,2 Prozent (26B: 82,6 Prozent). Damit übertrifft es die Vorgängerversion Gemma 3 27B.1
  • Das 12B-Modell benötigt nur halb so viel Speicher wie das 26B-Modell.2
Verfügbarkeit über zusätzliche Plattformen
  • Das Modell ist über Hugging Face und Kaggle herunterladbar.1
  • Das Modell ist über Hugging Face, Ollama und LM Studio verfügbar.3
Einordnung in die Gemma-4-Reihe
  • Das Unternehmen schließt damit eine Lücke in der Gemma-4-Reihe, die im April mit vier Modellen startete.2
  • Innerhalb der Gemma-4-Familie liegt das 12B-Modell zwischen den Edge-Varianten für Smartphones und dem größeren 26B-Modell.4
Fähigkeit zur Videoanalyse
  • Das Modell kann mehrminütige Videoclips analysieren, indem es Einzelbilder und Audiospur gemeinsam auswertet.3
Leistung ohne dedizierte GPU
  • Ohne dedizierte GPU verlängern sich die Rechenzeiten.4

Quellen (5)

Vollständige Übersicht mit allen Meldungen öffnen →