NVIDIA Developer Blog
Fuente de noticias de IA. Los artículos son seleccionados y adaptados por la redacción de Hamidun News.
Últimas publicaciones

NVIDIA Explica Cómo Crear un Transaction Foundation Model para Análisis Financiero
NVIDIA describió un enfoque para crear un modelo de fundación propio basado en datos de transacciones bancarias para la detección de fraude y un análisis más preciso del comportamiento financiero de los clientes.

NVIDIA XR AI: Cómo la Empresa Ayuda a los Desarrolladores a Construir Agentes de IA para Gafas AR
NVIDIA describió la brecha de infraestructura en el desarrollo de agentes de IA para gafas AR y dispositivos XR: el hardware está listo, pero integrar servicios de IA en vivo sigue siendo complejo.

NVIDIA describe GQE — plataforma para motores de procesamiento de consultas acelerados por GPU
NVIDIA publicó material técnico sobre GQE — una plataforma para diseñar motores de procesamiento de consultas acelerados por GPU limitados por ancho de banda de memoria.

NVIDIA Developer Blog Explica Técnicas de Aprendizaje Reforzado para Agentes de IA
NVIDIA Developer Blog publicó un desglose de técnicas de aprendizaje por refuerzo para agentes de IA—desde RLHF clásico hasta nuevos enfoques de entrenamiento de modelos basados en retroalimentación.

NVIDIA mostró optimización del pipeline NuRec a través de Nsight Developer Tools
NVIDIA explicó cómo los ingenieros aceleran la reconstrucción 3D de redes neuronales en Omniverse NuRec usando perfiladores Nsight Developer Tools.

NVIDIA describió paralelismo tensorial no uniforme para el entrenamiento de LLM en GPU
NVIDIA publicó en Developer Blog un análisis de la técnica de paralelismo tensorial no uniforme que aumenta el goodput en el entrenamiento de modelos de lenguaje grande en clusters de miles de GPU.

NVIDIA presenta perfil LangChain Deep Agents para modelo Nemotron 3 Ultra
NVIDIA lanzó orientaciones sobre configuración de un perfil harness LangChain Deep Agents bajo su modelo abierto Nemotron 3 Ultra — la configuración adecuada debe acercar la precisión a modelos de frontera propietarios c

NVIDIA acelera consultas analíticas Presto en la plataforma GPU GB200 NVL72
NVIDIA mostró la aceleración de GPU del motor SQL abierto Presto en la plataforma GB200 NVL72 para análisis de baja latencia en conjuntos de datos muy grandes.

NVIDIA DSX OS: sistema operativo abierto para fábricas de IA de cualquier escala
NVIDIA lanzó un SO modular para gestionar mega centros de datos con aceleradores de IA, resolviendo el problema de fragmentación del mercado.

NVIDIA Vera CPU: Nuevo Estándar para Tareas de IA Agéntica en Fábricas
El procesador Vera está especialmente optimizado para ejecutar cargas de trabajo agentivas en la era de la inferencia de IA escalable.

NVIDIA Cosmos 3: modelos para razonamiento y acciones en el mundo físico de robots
NVIDIA presentó Cosmos 3 — un conjunto de modelos fundamentales para IA física, incluidos modelos de mundo, modelos de razonamiento y modelos de acción para robots y sistemas autónomos.

NVIDIA DGX Spark: Agentes de IA Locales en Modelos Acelerados con Agrupamiento
NVIDIA introdujo soporte para agentes de IA locales en DGX Spark con modelos más rápidos y capacidades de clustering de múltiples nodos para cargas de trabajo escalables.

NVIDIA Alpamayo: Entrenamiento de Modelos en Bucle Cerrado para Vehículos Autónomos
NVIDIA presentó Alpamayo—una plataforma para el entrenamiento posterior de modelos de vehículos autónomos utilizando un ciclo cerrado de simulación y datos del mundo real.

NVIDIA DOCA: seguridad integrada para infraestructura de agentes de IA
NVIDIA presentó DOCA — una plataforma integrada en chips de red que proporciona garantías de seguridad integradas para "fábricas de IA" procesando datos en computación de redes neuronales.

NVIDIA NeMo genera datos financieros sintéticos para AI
NVIDIA presentó un método de generación sintética de datos financieros para entrenar LLMs, resolviendo el problema del desequilibrio de eventos raros en las noticias reales.

NVIDIA BioNeMo Agent Toolkit: acelerando la predicción de la estructura de proteínas
NVIDIA presentó BioNeMo Agent Toolkit para orquestar agentes de AI que automatizan todo el pipeline de predicción de la estructura de proteínas y co-folding, acelerando el desarrollo farmacéutico.

LLMs y hardware: NVIDIA sobre el equilibrio entre precisión, throughput y capacidad de respuesta
NVIDIA publicó recomendaciones para el diseño de LLM que exigen la optimización simultánea de tres parámetros: precisión, throughput y velocidad de respuesta para el usuario.

NVIDIA Vera CPU Aumenta el Rendimiento de AI-Factories para Cargas de Trabajo Agentivas
NVIDIA explicó cómo el procesador Vera CPU reduce los retrasos entre pasos de inferencia GPU y acelera los pipelines multi-paso agentivos en AI-factories industriales.

NVIDIA Confidential Computing: protección de datos durante la inferencia de AI sin pérdida de velocidad
NVIDIA explicó cómo la tecnología Confidential Computing protege los datos corporativos directamente durante la computación en GPU, sin sacrificar el rendimiento.

NVIDIA BioNeMo permite reentrenar modelos de IA biológica con LoRA en horas
NVIDIA ha lanzado BioNeMo Recipes, pipelines listos para el ajuste fino de los modelos de lenguaje ESM2 y Evo 2 mediante el método LoRA. Ahora especializarlos para tareas biológicas es posible con un par de GPU.

NVIDIA acelera el preentrenamiento de LLM: NVFP4 en Blackwell junto con JAX y MaxText
NVIDIA mostró cómo el formato NVFP4 en los chips Blackwell, junto con JAX y MaxText, reduce el tiempo de preentrenamiento de modelos frontier y los costes de cómputo.

NVIDIA JetPack 7.2: agentes de AI en dispositivos de borde con un solo comando de despliegue
NVIDIA lanzó JetPack 7.2 para la plataforma Jetson — un solo comando CLI despliega un stack completo de agentes con privacidad y optimización de memoria.

NVIDIA TensorRT convierte checkpoints FP8 en motores para inferencia rápida
NVIDIA explicó cómo convertir un checkpoint cuantizado en FP8 en un motor TensorRT — un paso que convierte un modelo optimizado en una herramienta real de producción.

NVIDIA: cómo diseñar sistemas de almacenamiento de energía en baterías para fábricas de AI
NVIDIA explicó en qué se diferencian las fábricas de AI de los centros de datos convencionales en términos de consumo energético y describió los requisitos para los sistemas de almacenamiento de energía en baterías (BESS

NVIDIA explicó cómo gestionar agentes autónomos en fábricas de AI empresariales
Los agentes de AI han ido mucho más allá del chat: trabajan durante horas con datos y sistemas empresariales, y NVIDIA explicó en detalle cómo construir un entorno seguro y gestionable para su despliegue.

NVIDIA explicó cómo entrenar transformers con precisión reducida sin perder calidad
NVIDIA publicó una guía para optimizar modelos transformer con FP8 y BF16 — cómo acelerar el entrenamiento y reducir el uso de memoria GPU sin perder precisión.

NVIDIA presenta Halos, un sistema de seguridad funcional para robots con IA
NVIDIA Halos es una pila completa de seguridad funcional para la IA física: robots que trabajan junto a personas en fábricas, almacenes y hospitales.

NVIDIA DAQIRI: inferencia de IA en tiempo real para la adquisición de datos de alta velocidad
NVIDIA presentó DAQIRI, un framework que integra la IA directamente en el flujo de datos de sensores e instrumentos científicos sin demoras.

NVIDIA lanza una guía para desplegar AI-Q Blueprint en Oracle Cloud Infrastructure
NVIDIA hizo posible el despliegue en producción de agentes de AI de largo plazo: AI-Q Blueprint ya está listo para ejecutarse en Oracle Cloud con seguridad de nivel empresarial.

NVIDIA optimizó el BEV pooling en GPU para vehículos autónomos, robots y AI espacial
NVIDIA publicó una guía para acelerar el BEV pooling en GPU — una operación clave para la percepción espacial en vehículos autónomos, robots y sistemas de AI espacial.