aiminute. ← Toute l’actu IA
Nouveaux Modèles 2026-08-11

Le nouveau modèle ouvert de Nvidia compte 30 milliards de paramètres et n'en utilise que 3 à la fois — et il tourne sur un ordinateur de bureau

Le nouveau modèle ouvert de Nvidia compte 30 milliards de paramètres et n'en utilise que 3 à la fois — et il tourne sur un ordinateur de bureau

Nvidia a publié Nemotron 3.5 Lightning le 11 août : un modèle à mélange d'experts de 30 milliards de paramètres qui n'en active que 3 milliards par jeton, avec une fenêtre de contexte allant jusqu'à un million de jetons et des poids sous la licence permissive OpenMDW-1.1 — les entreprises peuvent le télécharger, le modifier et bâtir dessus sans demander l'autorisation de Nvidia. Il vise la moitié ingrate du travail des agents : revue de code, appels d'outils, surveillance des alertes de sécurité, réponses aux questions de facturation, soit les étapes qu'un modèle de frontière planifierait sans avoir besoin de les exécuter lui-même. Nvidia revendique jusqu'à quatre fois la vitesse de sortie et 30 % de rapidité en plus pour l'accomplissement des tâches agentiques par rapport aux modèles de taille comparable, et annonce 81,62 en MMLU Pro, 75,57 en GPQA Diamond et 52,80 en SWE-bench Verified. Il fonctionne en local sur PC RTX, DGX Spark, DGX Station et cartes Jetson, monte en charge jusqu'aux centres de données, et est disponible sur Hugging Face, ModelScope et OpenRouter. Nvidia a aussi ouvert le code de NeMo Switchyard, une bibliothèque de routage qui confie chaque étape d'un flux de travail au modèle le moins cher capable de la traiter ; selon les mesures de Nvidia, une configuration routée par Switchyard revient à près d'un tiers du coût d'un recours systématique à Opus 4.8.

Pourquoi c'est importantLe routeur compte peut-être plus que le modèle. L'argument de Nvidia : le système de frontière, coûteux, devrait planifier et presque rien d'autre, car l'essentiel de ce que fait réellement un agent relève de tâches petites et répétitives, confiables à un modèle qui tient sur une station de travail. C'est une attaque directe contre le modèle économique au jeton des laboratoires auxquels Nvidia vend ses puces — et Nvidia a livré les deux moitiés de cet argument le même jour, gratuitement. Pour qui fait tourner des agents avec un budget serré — un laboratoire scolaire, une petite équipe, un développeur seul — la lecture pratique est que l'option du modèle local vient de gagner un candidat sérieux, sous une licence qui ne réclame la permission de personne.
#Code#Agents IA

✓ Vérifié · 3 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

Rumeur : le modèle anonyme qui vient de dominer un test de programmation, gratuitement, serait le fleuron non publié de Zhipu
2026-08-21
Le cheval de trait bon marché de DeepSeek voit désormais — et sur les tâches d'agent qui exigent des yeux, il se dit proche du meilleur d'Anthropic
2026-08-21
Nvidia paie 6 milliards de dollars pour la machine qui fabrique les modèles d'un rival — et embauche 109 de ceux qui la faisaient tourner
2026-08-21
Quatre heures et un GPU pour améliorer la façon dont on entraîne l'IA : le meilleur agent obtient 0,25 sur 1 — et la plupart n'ont même pas essayé
2026-08-21
ChatGPT peut désormais lire vos iMessages et les envoyer — et le réglage qui lui évite de demander est celui-là même dont OpenAI met en garde
2026-08-21