Nouveaux Modèles
2026-08-09
Le nouveau modèle d'Ant Group compte 7,9 milliards de paramètres et n'en utilise que 1,3 à la fois — gratuit jusqu'à vendredi
InclusionAI, la division modèles d'Ant Group, a publié Ling-3.0-tiny le 6 août. C'est un modèle à mélange d'experts de 7,9 milliards de paramètres au total, qui n'en active qu'environ 1,3 milliard pour chaque jeton produit, avec une fenêtre de contexte de 256 000 jetons et jusqu'à 32 000 jetons en sortie. Comme son grand frère Ling-3.0-flash, sorti deux semaines plus tôt avec 124 milliards de paramètres, c'est un modèle à raisonnement hybride natif : il peut basculer entre un mode instantané et un mode réflexion au lieu d'être l'un ou l'autre. Il prend en charge l'appel de fonctions natif et la mise en cache des invites, et Ant le destine aux agents, au suivi d'instructions et aux déploiements sur matériel contraint. Il est déjà disponible sur OpenRouter et sur l'AI Gateway de Vercel, gratuitement jusqu'au 14 août à 8 h heure du Pacifique, où il a repris la place gratuite qu'occupait Ling-3.0-flash. Les poids ouverts ne sont pas encore publiés ; Ant annonce qu'ils arrivent.
Pourquoi c'est importantLe chiffre intéressant ici n'est pas 7,9 milliards, c'est 1,3 milliard. Un modèle qui ne réveille qu'une petite fraction de lui-même par jeton coûte bien moins cher à faire tourner et tient sur du matériel inaccessible aux modèles de frontière : un ordinateur portable, un téléphone, une machine d'atelier sans connexion fiable. Les laboratoires chinois passent l'année à pousser ce rapport, et Ling-3.0-flash affirmait déjà égaler le vaisseau amiral à mille milliards de paramètres d'Ant avec une fraction du calcul. Deux réserves avant de s'enthousiasmer : les poids ne sont pas sortis, donc pour l'instant il s'agit d'une API que l'on loue, pas d'un modèle que l'on possède ; et la fenêtre gratuite se ferme vendredi. Si vous voulez vérifier qu'un petit modèle de classe locale suffit à votre usage, cette semaine est le moment économique pour le savoir.
✓ Vérifié · 3 sources
Lire dans l'app — gratuit, en 9 langues
Actus liées
Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21Montrez-le au robot une fois — de trois à douze secondes — et il réussit 59 fois sur 100 sans le moindre entraînement
2026-08-21L'agent a inventé une seconde personne pour cautionner son code. Un étudiant de 24 ans au Texas n'a cru ni l'un ni l'autre.
2026-08-21