Industria
AI Minute Newsroom
2026-08-25
Nvidia dice que su nuevo rack hace 30 veces más trabajo de agente por megavatio: la prueba la corrió ella misma y los autores del banco de pruebas aún no la han validado
El 24 de agosto Nvidia publicó cifras medidas sobre silicio para Vera Rubin NVL72, con hasta 30 veces más rendimiento por megavatio y hasta 35 veces menos coste por token que el GB300 NVL72 al que sustituye. La carga fue AgentX, de SemiAnalysis —grabaciones de sesiones reales de programación con agentes—, ejecutada sobre Kimi K3, MiniMax M3, GLM 5.3, Qwen 3.5 y DeepSeek V4 Pro con contextos superiores a 140.000 tokens. Nvidia afirma que la plataforma está en plena producción y señala en el mismo texto que los resultados están pendientes de revisión por SemiAnalysis y que todavía no reflejan el desempeño de la CPU Vera en llamadas a herramientas. Esa misma semana, en Hot Chips, detalló el rack: 2 zettaFLOPS de inferencia NVFP4 y 11 petabytes de HBM4 en un edificio de 100MW, refrigeración líquida a 45°C y bandejas de cómputo sin ventiladores ni cables.
Por qué importaLa capacidad de IA se raciona hoy por electricidad y no por chips: el hardware llega en meses, pero una conexión a la red la espera un centro de datos durante años. Una mejora de 30 veces en trabajo por megavatio, si la confirman revisores externos, cambia cuánta IA compra un contrato eléctrico fijo, y ese es el número que decide dónde se levantan los próximos edificios. Conviene retener dos cosas: la medición es de Nvidia, sobre hardware de Nvidia, antes de que los autores del banco de pruebas la revisaran, y todos los modelos del ensayo son chinos y de pesos abiertos, lo que dice en voz baja qué considera hoy la industria una carga de inferencia seria.
✓ Verificado · 2 fuentes
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
El nuevo Mac Studio lleva 512GB de memoria que la GPU puede direccionar directamente: un modelo de tamaño rack, debajo del escritorio
2026-08-25ByteDance ha metido su herramienta de programación y su constructor de agentes en una sola aplicación, y la ha apuntado a la oficina
2026-08-25Los grupos de intrusión vinculados a Estados más que duplicaron su volumen de ataques al pasarle a un modelo la parte aburrida
2026-08-25Un laboratorio perdió los 40.000 chips con los que iba a entrenar. Así que vendió la fábrica a la empresa que los fabrica.
2026-08-25Los modelos que se escaparon de su propio examen para copiar tienen ahora a un fiscal estatal pidiendo los registros
2026-08-25