aiminute. ← Todas las noticias de IA
Nuevos Modelos 2026-08-11

El nuevo modelo abierto de Nvidia tiene 30.000 millones de parámetros y usa 3.000 a la vez — y funciona en un ordenador de sobremesa

El nuevo modelo abierto de Nvidia tiene 30.000 millones de parámetros y usa 3.000 a la vez — y funciona en un ordenador de sobremesa

Nvidia publicó Nemotron 3.5 Lightning el 11 de agosto: un modelo de mezcla de expertos de 30.000 millones de parámetros que activa solo 3.000 millones por token, con una ventana de contexto de hasta un millón de tokens y pesos bajo la licencia permisiva OpenMDW-1.1 — las empresas pueden descargarlo, modificarlo y construir sobre él sin pedir permiso a Nvidia. Está pensado para la mitad menos vistosa del trabajo de los agentes: revisión de código, llamadas a herramientas, vigilancia de alertas de seguridad, respuestas sobre facturación; los pasos que un modelo de frontera planificaría pero no necesita ejecutar él mismo. Nvidia afirma hasta cuatro veces más velocidad de salida y un 30% más de rapidez al completar tareas agénticas frente a modelos de tamaño similar, y declara 81,62 en MMLU Pro, 75,57 en GPQA Diamond y 52,80 en SWE-bench Verified. Funciona en local sobre PC con RTX, DGX Spark, DGX Station y placas Jetson, además de escalar a centros de datos, y está disponible en Hugging Face, ModelScope y OpenRouter. Junto al modelo, Nvidia liberó NeMo Switchyard, una biblioteca de enrutado que envía cada paso de un flujo de trabajo al modelo más barato capaz de resolverlo; según las pruebas de la propia Nvidia, una configuración enrutada con Switchyard cuesta cerca de un tercio de lo que costaría usar Opus 4.8 para todo.

Por qué importaEl enrutador puede importar más que el modelo. Nvidia sostiene que el sistema de frontera, caro, debería planificar y casi nada más: la mayor parte de lo que hace realmente un agente es trabajo pequeño y repetitivo que puede delegarse en algo que cabe en una estación de trabajo. Es un ataque directo al negocio por token de los laboratorios a los que Nvidia vende chips, y Nvidia ha publicado las dos mitades del argumento el mismo día, gratis. Para quien ejecuta agentes con presupuesto ajustado — un laboratorio escolar, un equipo pequeño, un desarrollador solo — la lectura práctica es que la opción del modelo local acaba de ganar un candidato serio, con una licencia que no exige el permiso de nadie.
#Programación#Agentes IA

✓ Verificado · 3 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

Rumor: el modelo anónimo que acaba de encabezar un test de programación, gratis, sería el buque insignia sin publicar de Zhipu
2026-08-21
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21
Nvidia paga 6.000 millones de dólares por la máquina que fabrica los modelos de un rival — y contrata a 109 de quienes la manejaban
2026-08-21
Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21
ChatGPT ya puede leer tus iMessages y enviarlos — y el ajuste que le permite dejar de preguntar es justo el que OpenAI advierte
2026-08-21