aiminute. ← Toute l’actu IA
Nouveaux Modèles AI Minute Newsroom 2026-08-11

Le nouveau modèle ouvert de Nvidia compte 30 milliards de paramètres et n'en utilise que 3 à la fois — et il tourne sur un ordinateur de bureau

Le nouveau modèle ouvert de Nvidia compte 30 milliards de paramètres et n'en utilise que 3 à la fois — et il tourne sur un ordinateur de bureau

Nvidia a publié Nemotron 3.5 Lightning le 11 août : un modèle à mélange d'experts de 30 milliards de paramètres qui n'en active que 3 milliards par jeton, avec une fenêtre de contexte allant jusqu'à un million de jetons et des poids sous la licence permissive OpenMDW-1.1 — les entreprises peuvent le télécharger, le modifier et bâtir dessus sans demander l'autorisation de Nvidia. Il vise la moitié ingrate du travail des agents : revue de code, appels d'outils, surveillance des alertes de sécurité, réponses aux questions de facturation, soit les étapes qu'un modèle de frontière planifierait sans avoir besoin de les exécuter lui-même. Nvidia revendique jusqu'à quatre fois la vitesse de sortie et 30 % de rapidité en plus pour l'accomplissement des tâches agentiques par rapport aux modèles de taille comparable, et annonce 81,62 en MMLU Pro, 75,57 en GPQA Diamond et 52,80 en SWE-bench Verified. Il fonctionne en local sur PC RTX, DGX Spark, DGX Station et cartes Jetson, monte en charge jusqu'aux centres de données, et est disponible sur Hugging Face, ModelScope et OpenRouter. Nvidia a aussi ouvert le code de NeMo Switchyard, une bibliothèque de routage qui confie chaque étape d'un flux de travail au modèle le moins cher capable de la traiter ; selon les mesures de Nvidia, une configuration routée par Switchyard revient à près d'un tiers du coût d'un recours systématique à Opus 4.8.

Pourquoi c'est importantLe routeur compte peut-être plus que le modèle. L'argument de Nvidia : le système de frontière, coûteux, devrait planifier et presque rien d'autre, car l'essentiel de ce que fait réellement un agent relève de tâches petites et répétitives, confiables à un modèle qui tient sur une station de travail. C'est une attaque directe contre le modèle économique au jeton des laboratoires auxquels Nvidia vend ses puces — et Nvidia a livré les deux moitiés de cet argument le même jour, gratuitement. Pour qui fait tourner des agents avec un budget serré — un laboratoire scolaire, une petite équipe, un développeur seul — la lecture pratique est que l'option du modèle local vient de gagner un candidat sérieux, sous une licence qui ne réclame la permission de personne.
#Code#Agents IA

✓ Vérifié · 3 sources

WhatsApp X Telegram
Lire dans l'app — gratuit, en 9 langues

Actus liées

TikTok a glissé un chatbot d'achat dans la vidéo que vous regardez.
2026-10-06
Reflection va offrir un modèle de 501 milliards de paramètres.
2026-10-06
Wikimédia soupçonne des agents d'OpenAI pour la panne de mai.
2026-10-06
Le nouveau modèle de Microsoft écrit avant que vous ayez fini.
2026-10-05
Un laboratoire américain va offrir un modèle de niveau chinois.
2026-10-05