Nouveaux Modèles
AI Minute Newsroom
2026-08-22
Un modèle de huit milliards de paramètres qui lit les images et les dessine en 4K, sous licence Apache — la communauté le faisait tourner en deux jours
SenseTime a déposé les poids de SenseNova-U1.5-8B-MoT sur Hugging Face le 19 août sous licence Apache-2.0, suivis le même jour d'une variante affinée et, le 20 août, d'un jeu de LoRA. Ce n'est pas une chaîne de traitement mais un seul modèle multimodal natif : les mêmes huit milliards de paramètres qui regardent une image la génèrent et la retouchent aussi, une approche que le laboratoire appelle NEO-unify. Les notes de version revendiquent six gains précis sur la version précédente : meilleure composition et rendu des matières, texte chinois et anglais plus lisible dans les affiches et les infographies, génération native en 4K plus efficace, retouches qui laissent intactes les parties non modifiées, meilleure obéissance aux consignes empilant nombres d'objets et relations spatiales, et contrôle plus fin par boîtes englobantes et images de référence. Plus facile à vérifier : ce qui a suivi. En une quarantaine d'heures, la communauté avait livré des conversions GGUF et FP8, un export ONNX et un paquet ComfyUI, si bien que le modèle tourne sur des postes de travail ordinaires. Le dépôt principal affiche environ 950 téléchargements et 91 mentions ; le code de référence est sur GitHub et les poids sont aussi sur ModelScope. Une limite qu'il faut dire : SenseTime a publié ses comparaisons sous forme de graphiques et non de tableaux, et aucune évaluation indépendante n'a encore eu lieu ; les affirmations de classement restent celles du laboratoire.
Pourquoi c'est importantL'intéressant n'est pas le tableau de scores, c'est la forme. La plupart des outils d'image téléchargeables reposent sur un modèle qui dessine et un autre qui regarde ; ici, un même jeu de poids fait les deux, assez petit pour tourner sur la machine qu'on possède déjà, sous une licence qui autorise à vendre ce qu'on en tire. Le 4K natif compte pour une raison tout aussi prosaïque : c'est la différence entre une image utilisable pour une affiche et une image qu'il faut agrandir. Quant aux deux jours qui séparent un laboratoire chinois publiant des poids et quelqu'un les faisant tourner dans ComfyUI, c'est désormais la vitesse normale de cet écosystème : une sortie n'est plus une annonce, c'est un téléchargement qui atterrit la semaine même sur les machines d'inconnus.
✓ Vérifié · 4 sources
▶ Vidéo associée: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
Lire dans l'app — gratuit, en 9 langues
Actus liées
Les modèles ouverts de Google ont été téléchargés un milliard de fois, et l'extérieur en a fabriqué 100 000 versions
2026-08-22Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21Montrez-le au robot une fois — de trois à douze secondes — et il réussit 59 fois sur 100 sans le moindre entraînement
2026-08-21Il y a six mois, Hollywood adressait une mise en demeure à ByteDance. Cette semaine, les deux camps ont signé une trêve — sans qu'un dollar change de mains.
2026-08-20Le modèle invente ses propres exercices, construit le banc d'essai qui les évalue, puis s'entraîne sur le résultat — et DeepReinforce a donné les poids
2026-08-20