NVIDIA Vera Rubin NVL72: Revolución en la Eficiencia de Agentes de IA
Up to 30x More Work Per Watt: NVIDIA Vera Rubin NVL72 Sets a New Efficiency Standard for AI Agents
NVIDIA ha presentado su nuevo sistema Vera Rubin NVL72, que establece un nuevo estándar de eficiencia para agentes de inteligencia artificial (IA). Según los datos de OpenRouter, las cargas de trabajo de IA agentica consumen 15 veces más tokens que una simple solicitud de chat. Esto se debe a que los agentes de IA, al investigar una empresa para una decisión de inversión, consultan bases de datos financieras, buscan noticias y archivos, invocan sub-agentes para realizar comparaciones y modelar valoraciones, y luego sintetizan todo en una recomendación. Este proceso incrementa la demanda de tokens, convirtiendo la gestión de contextos extensos en un aspecto central del rendimiento de la IA agentica.
Los nuevos datos de rendimiento medidos muestran que los sistemas NVIDIA Vera Rubin NVL72 ofrecen hasta 30 veces más rendimiento por megavatio que el NVIDIA GB300 NVL72 en cargas de trabajo agenticas. Este avance se traduce directamente en 30 veces más trabajo agentico para la misma huella energética, lo cual es crucial para las fábricas de IA con restricciones de energía.
En el análisis de rendimiento SemiAnalysis AgentX, la plataforma Blackwell de NVIDIA ofrece un rendimiento líder en múltiples modelos agenticos, incluyendo Kimi K3, MiniMax M3, GLM5.3, Qwen3.5 y DeepSeek V4 Pro. Por ejemplo, el GB300 NVL72 ofrece hasta 15 veces mejor rendimiento por megavatio que la arquitectura NVIDIA Hopper en el modelo DeepSeek V4 Pro, proporcionando una base de alto rendimiento para ejecutar cargas de trabajo agenticas.
Vera Rubin extiende esa ventaja, elevando el rendimiento a lo largo de toda la curva de Pareto, para ofrecer hasta 30 veces más rendimiento por megavatio que el GB300 NVL72 en el modelo DeepSeek V4 Pro. Estos resultados iniciales, medidos utilizando la carga de trabajo SemiAnalysis AgentX y actualmente pendientes de revisión por SemiAnalysis, aún no reflejan el rendimiento de la CPU Vera para la llamada de herramientas.
Las tecnologías NVIDIA DSX MaxLPS gestionan la energía a través de la GPU, rack y niveles de carga de trabajo para provisionar hasta un 40% más de GPUs dentro del mismo presupuesto de megavatios, aumentando aún más el rendimiento por megavatio a escala de fábrica de IA.
El rendimiento por megavatio también impacta directamente en el costo de cada token producido. Con un costo hasta 35 veces menor por millón de tokens que el GB300 NVL72, Vera Rubin NVL72 puede ejecutar agentes de manera continua, a escala, a lo largo de toda la gama de cargas de trabajo de los clientes.
Para las fábricas de IA con restricciones de energía, el rendimiento por megavatio determina los ingresos de la fábrica de IA y el costo por millón de tokens determina el margen de beneficio sobre esos ingresos.
Fuente: https://blogs.nvidia.com/blog/vera-rubin-nvl72-efficiency-ai-agents/
¿Te ha interesado esta noticia?
Recibe cada mañana el resumen de IA y sociedad directo en tu email.
Suscríbete gratis →