aiminute. ← Alle KI-News
Neue Modelle AI Minute Newsroom 2026-08-22

Ein Modell mit acht Milliarden Parametern, das Bilder liest und in 4K zeichnet, unter Apache-Lizenz — und die Community hatte es in zwei Tagen laufen

Ein Modell mit acht Milliarden Parametern, das Bilder liest und in 4K zeichnet, unter Apache-Lizenz — und die Community hatte es in zwei Tagen laufen

SenseTime stellte die Gewichte von SenseNova-U1.5-8B-MoT am 19. August unter Apache-2.0-Lizenz auf Hugging Face, am selben Tag folgte eine feinabgestimmte Variante, am 20. August ein Satz LoRAs. Es ist keine Verarbeitungskette, sondern ein einziges natives multimodales Modell: Dieselben acht Milliarden Parameter, die ein Bild ansehen, erzeugen und bearbeiten es auch — das Labor nennt den Ansatz NEO-unify. Die Versionshinweise beanspruchen sechs konkrete Verbesserungen gegenüber der Vorversion: bessere Komposition und Materialdarstellung, lesbarerer chinesischer und englischer Text in Plakaten und Infografiken, effizientere native 4K-Erzeugung, Bearbeitungen, die unberührte Bildteile in Ruhe lassen, zuverlässigeres Befolgen von Anweisungen, die Objektzahlen und räumliche Beziehungen stapeln, und feinere Steuerung über Begrenzungsrahmen und Referenzbilder. Leichter zu prüfen ist, was danach geschah. Binnen rund achtundvierzig Stunden hatte die Community GGUF- und FP8-Konvertierungen, einen ONNX-Export und ein ComfyUI-Paket geliefert, sodass das Modell auf gewöhnlichen Arbeitsplatzrechnern läuft. Das Hauptrepository steht bei etwa 950 Downloads und 91 Likes; Referenzcode liegt auf GitHub, die Gewichte auch auf ModelScope. Eine ehrliche Grenze: SenseTime veröffentlichte seine Vergleichsmessungen als Diagramme statt als Tabellen, und eine unabhängige Auswertung fehlt bislang — die Ranglistenaussagen sind also die des Labors.

Warum es wichtig istInteressant ist nicht die Punktetafel, sondern die Bauform. Die meisten herunterladbaren Bildwerkzeuge bestehen aus einem Modell, das zeichnet, und einem, das schaut; hier erledigt ein einziger Satz Gewichte beides, klein genug für den Rechner, den man ohnehin besitzt, mit einer Lizenz, die den Verkauf des Ergebnisses erlaubt. Natives 4K zählt aus einem ebenso unglamourösen Grund: Es entscheidet, ob ein Bild direkt für ein Plakat taugt oder erst hochskaliert werden muss. Und die zwei Tage zwischen einem chinesischen Labor, das Gewichte veröffentlicht, und jemandem, der sie in ComfyUI laufen lässt, sind inzwischen die Normalgeschwindigkeit dieses Ökosystems: Eine Veröffentlichung ist keine Ankündigung mehr, sondern ein Download, der noch in derselben Woche auf fremden Rechnern landet.
#Bildgenerierung

✓ Verifiziert · 4 Quellen

▶ Passendes Video: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
WhatsApp X Telegram
In der App lesen — kostenlos, 9 Sprachen

Verwandte Meldungen

Googles offene Modelle wurden eine Milliarde Mal heruntergeladen, und Außenstehende haben 100.000 Versionen daraus gebaut
2026-08-22
DeepSeeks günstiges Arbeitspferd kann jetzt sehen — bei Agentenaufgaben mit Bildern will es nahe an Anthropics Bestem sein
2026-08-21
Einmal vormachen — drei bis zwölf Sekunden — und der Roboter erledigt die Aufgabe ganz ohne Training 59 von 100 Mal richtig
2026-08-21
Vor sechs Monaten schickte Hollywood ByteDance eine Unterlassungsaufforderung. Diese Woche unterzeichneten beide einen Waffenstillstand — und es floss kein Geld.
2026-08-20
Das Modell erfindet seine eigenen Aufgaben, baut den Prüfstand dafür und trainiert dann mit dem Ergebnis — und DeepReinforce hat die Gewichte verschenkt
2026-08-20