Neue Modelle
2026-08-01
MiniMax' H3 erzeugt 2K-Video mit eingebautem Stereo-Ton — zu einem Drittel des Konkurrenzpreises
Das Shanghaier Unternehmen MiniMax hat am 31. Juli H3 veröffentlicht: ein Videomodell, das Text, Bilder, Video und Audio als eine kombinierte Eingabe liest und Clips von 5 bis 15 Sekunden mit bis zu 2K und 24fps liefert — Stimme, Soundeffekte und Musik entstehen dabei gemeinsam mit dem Bild als nativer Stereo-Ton statt nachträglich. Außerdem kann es vorhandenes Material bearbeiten und Bewegungen zwischen Videos übertragen. Laut MiniMax kostet 2K-Generierung weniger als ein Drittel der gängigen Konkurrenz; die Modellgewichte sollen 'in den kommenden Tagen' geöffnet werden.
Warum es wichtig istVideogenerierung rast auf dasselbe Schicksal zu wie Text: besser, billiger, offen. Gemeinsam mit dem Bild erzeugter Ton beseitigt eine der letzten verräterischen Nahtstellen von KI-Video — und kommen die versprochenen offenen Gewichte, wird der Werkzeugkasten für Kreative wie Fälscher dramatisch billiger. Preisdruck auf Sora, Veo und Runway inklusive.
✓ Verifiziert · 3 Quellen
In der App lesen — kostenlos, 9 Sprachen
Verwandte Meldungen
Apple Music zeigt künftig an, wenn ein Song von einer Maschine stammt — ob das jemand angibt, entscheidet der Uploader
2026-08-21DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21Adobe erzeugt jetzt die Musik, die Sprecherstimme und das zuschlagende Türgeräusch — und sagt, die Lizenz decke Sie ab
2026-08-21Einmal vormachen — drei bis zwölf Sekunden — und der Roboter erledigt die Aufgabe ganz ohne Training 59 von 100 Mal richtig
2026-08-21Vor sechs Monaten schickte Hollywood ByteDance eine Unterlassungsaufforderung. Diese Woche unterzeichneten beide einen Waffenstillstand — und es floss kein Geld.
2026-08-20