Im Quellenvergleich
Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.
Der chinesische KI-Anbieter MiniMax hat die Gewichte seines neuen Videomodells H3 freigegeben. Laut der Benchmark-Plattform Artificial Analysis ist H3 das weltweit stärkste KI-Modell für Videobearbeitung. Bei Text-zu-Video-Aufgaben liegt es hinter Googles Gemini Omni Flash, bei Bild-zu-Video-Fähigkeiten hinter ByteDances Seedance 2.0 und Gemini Omni Flash. Die Lizenz erlaubt kostenlose nicht-kommerzielle Nutzung sowie kommerzielle Nutzung für Organisationen mit weniger als 20 Millionen US-Dollar Jahresumsatz. Das Modell verarbeitet Text, Bilder, Videos und Audio gemeinsam und erzeugt einen vier bis 15 Sekunden langen Clip mit Stereo-Ton. Zwei Bausteine bleiben geschlossen: das Modul für 2K-Auflösung und H3-Context-IR, das Prompts in eine strukturierte Zwischenform übersetzt. Lokal in ComfyUI erhält man daher 768p. Die Kontextaufbereitung lässt sich anhand veröffentlichter Leitfäden selbst nachbauen. Feintuning ist möglich. Zeitgleich veröffentlichte ByteDance das geschlossene Seedance 2.5, das 30-Sekunden-Clips mit Audio liefert.