Neue Modelle
AI Minute Newsroom
2026-08-01
MiniMax' H3 erzeugt 2K-Video mit eingebautem Stereo-Ton — zu einem Drittel des Konkurrenzpreises
Das Shanghaier Unternehmen MiniMax hat am 31. Juli H3 veröffentlicht: ein Videomodell, das Text, Bilder, Video und Audio als eine kombinierte Eingabe liest und Clips von 5 bis 15 Sekunden mit bis zu 2K und 24fps liefert — Stimme, Soundeffekte und Musik entstehen dabei gemeinsam mit dem Bild als nativer Stereo-Ton statt nachträglich. Außerdem kann es vorhandenes Material bearbeiten und Bewegungen zwischen Videos übertragen. Laut MiniMax kostet 2K-Generierung weniger als ein Drittel der gängigen Konkurrenz; die Modellgewichte sollen 'in den kommenden Tagen' geöffnet werden.
Warum es wichtig istVideogenerierung rast auf dasselbe Schicksal zu wie Text: besser, billiger, offen. Gemeinsam mit dem Bild erzeugter Ton beseitigt eine der letzten verräterischen Nahtstellen von KI-Video — und kommen die versprochenen offenen Gewichte, wird der Werkzeugkasten für Kreative wie Fälscher dramatisch billiger. Preisdruck auf Sora, Veo und Runway inklusive.
✓ Verifiziert · 3 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Microsofts neues Modell schreibt, bevor Sie fertig gesprochen haben.
2026-10-05ElevenLabs schenkt Studenten ein Jahr seiner Lesestimme.
2026-10-05Ein US-Labor verschenkt bald ein Modell auf Chinas Niveau.
2026-10-05Eine Videoseite verschenkt das beste offene Übersetzungsmodell.
2026-10-05Die Hälfte der Angerufenen hielt die KI für einen Menschen.
2026-10-04