NVIDIA Developer Blog
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

NVIDIA Explica Como Criar um Transaction Foundation Model para Análise Financeira
NVIDIA descreveu uma abordagem para criar um modelo de fundação próprio baseado em dados de transações bancárias para detecção de fraude e análise mais precisa do comportamento financeiro dos clientes.

NVIDIA XR AI: Como a Empresa Ajuda Desenvolvedores a Construir Agentes de IA para Óculos AR
NVIDIA descreveu a lacuna de infraestrutura no desenvolvimento de agentes de IA para óculos AR e dispositivos XR: o hardware está pronto, mas integrar serviços de IA ao vivo continua complexo.

NVIDIA descreve GQE — plataforma para mecanismos de processamento de consultas acelerados por GPU
NVIDIA publicou material técnico sobre GQE — uma plataforma para projetar mecanismos de processamento de consultas acelerados por GPU limitados pela largura de banda da memória.

NVIDIA Developer Blog Explica Técnicas de Aprendizado por Reforço para Agentes de IA
NVIDIA Developer Blog publicou um detalhamento das técnicas de aprendizado por reforço para agentes de IA—desde RLHF clássico até novas abordagens de treinamento de modelos baseadas em feedback.

NVIDIA mostrou otimização do pipeline NuRec via Nsight Developer Tools
NVIDIA explicou como os engenheiros aceleram a reconstrução 3D de rede neural em Omniverse NuRec usando profilers Nsight Developer Tools.

NVIDIA descreveu paralelismo tensorial não uniforme para treinamento de LLM em GPUs
NVIDIA publicou no Developer Blog uma análise da técnica de paralelismo tensorial não uniforme que aumenta o goodput no treinamento de modelos de linguagem grande em clusters de milhares de GPUs.

NVIDIA apresenta perfil LangChain Deep Agents para o modelo Nemotron 3 Ultra
NVIDIA lançou orientações sobre configuração de um perfil harness LangChain Deep Agents sob seu modelo aberto Nemotron 3 Ultra — a configuração adequada deve aproximar a precisão de modelos de fronteira proprietários com

NVIDIA acelera consultas analíticas Presto na plataforma GPU GB200 NVL72
NVIDIA mostrou a aceleração de GPU do mecanismo SQL aberto Presto na plataforma GB200 NVL72 para análise de baixa latência em conjuntos de dados muito grandes.

NVIDIA DSX OS: sistema operacional aberto para fábricas de IA de qualquer escala
NVIDIA lançou um SO modular para gerenciar mega data centers com aceleradores de IA, resolvendo o problema de fragmentação do mercado.

NVIDIA Vera CPU: Novo Padrão para Tarefas de IA de Agentes em Fábricas
O processador Vera é especialmente otimizado para executar cargas de trabalho agentivas na era da inferência de IA escalável.

NVIDIA Cosmos 3: modelos para raciocínio e ações no mundo físico de robôs
NVIDIA apresentou Cosmos 3 — um conjunto de modelos fundamentais para IA física, incluindo modelos de mundo, modelos de raciocínio e modelos de ação para robôs e sistemas autônomos.

NVIDIA DGX Spark: Agentes de IA Locais em Modelos Acelerados com Clustering
NVIDIA introduziu suporte para agentes de IA locais no DGX Spark com modelos mais rápidos e recursos de clustering de múltiplos nós para cargas de trabalho escaláveis.

NVIDIA Alpamayo: Treinamento de Modelos em Loop Fechado para Veículos Autônomos
NVIDIA apresentou Alpamayo—uma plataforma para pós-treinamento de modelos de veículos autônomos usando um ciclo fechado de simulação e dados do mundo real.

NVIDIA DOCA: segurança integrada para infraestrutura de agentes de IA
NVIDIA apresentou DOCA — uma plataforma integrada em chips de rede que fornece garantias de segurança integradas para "fábricas de IA" processando dados em computação de redes neurais.

NVIDIA NeMo gera dados financeiros sintéticos para AI
A NVIDIA apresentou um método de geração sintética de dados financeiros para treinar LLMs, resolvendo o problema do desequilíbrio de eventos raros nas notícias reais.

NVIDIA BioNeMo Agent Toolkit: acelerando a predição da estrutura de proteínas
A NVIDIA apresentou o BioNeMo Agent Toolkit para orquestrar agentes de AI que automatizam todo o pipeline de predição da estrutura de proteínas e co-folding, acelerando o desenvolvimento farmacêutico.

LLMs e hardware: NVIDIA sobre o equilíbrio entre precisão, throughput e responsividade
A NVIDIA publicou recomendações para o projeto de LLMs que exigem a otimização simultânea de três parâmetros: precisão, throughput e velocidade de resposta para o usuário.

NVIDIA Vera CPU Aumenta a Vazão de AI-Factories para Cargas de Trabalho Agentivas
NVIDIA explicou como o processador Vera CPU reduz atrasos entre etapas de inferência GPU e acelera pipelines multi-etapa agentivos em AI-factories industriais.

NVIDIA Confidential Computing: proteção de dados durante a inferência de AI sem perda de velocidade
A NVIDIA explicou como a tecnologia Confidential Computing protege dados corporativos diretamente durante a computação em GPU, sem sacrificar o desempenho.

NVIDIA BioNeMo permite reajustar modelos de IA biológica com LoRA em horas
A NVIDIA lançou o BioNeMo Recipes — pipelines prontos para o ajuste fino dos modelos de linguagem ESM2 e Evo 2 pelo método LoRA. Agora é possível especializá-los para tarefas biológicas com apenas um par de GPUs.

NVIDIA acelera o pré-treinamento de LLM: NVFP4 no Blackwell em conjunto com JAX e MaxText
A NVIDIA mostrou como o formato NVFP4 nos chips Blackwell, em conjunto com JAX e MaxText, reduz o tempo de pré-treinamento de modelos frontier e os custos de computação.

NVIDIA JetPack 7.2: agentes de AI em dispositivos de borda com um único comando de deploy
A NVIDIA lançou o JetPack 7.2 para a plataforma Jetson — um único comando CLI implanta um stack completo de agentes com privacidade e otimização de memória.

NVIDIA TensorRT transforma checkpoints FP8 em motores para inferência rápida
NVIDIA explicou como converter um checkpoint quantizado em FP8 em um motor TensorRT — uma etapa que transforma um modelo otimizado em uma ferramenta real de produção.

NVIDIA: como projetar sistemas de armazenamento de energia em baterias para fábricas de AI
A NVIDIA explicou em que as fábricas de AI diferem dos data centers convencionais em termos de consumo de energia e descreveu os requisitos para sistemas de armazenamento de energia em baterias (BESS) nesses locais.

NVIDIA explicou como gerenciar agentes autônomos em fábricas de AI corporativas
Os agentes de AI foram muito além do chat — eles trabalham por horas com dados e sistemas corporativos, e a NVIDIA explicou em detalhes como estruturar um ambiente seguro e gerenciável para sua implantação.

A NVIDIA explicou como treinar transformers com precisão reduzida sem perda de qualidade
A NVIDIA publicou um guia para otimizar modelos transformer com FP8 e BF16 — como acelerar o treinamento e reduzir o uso de memória de GPU sem perda de precisão.

NVIDIA apresenta o Halos — um sistema de segurança funcional para robôs com IA
O NVIDIA Halos é uma pilha completa de segurança funcional para a IA física: robôs que trabalham ao lado de pessoas em fábricas, armazéns e hospitais.

NVIDIA DAQIRI: inferência de IA em tempo real na coleta de dados de alta velocidade
A NVIDIA apresentou o DAQIRI, um framework que incorpora IA diretamente no fluxo de dados de sensores e instrumentos científicos sem atrasos.

NVIDIA lança guia para implantar o AI-Q Blueprint na Oracle Cloud Infrastructure
A NVIDIA tornou possível a implantação em produção de agentes de AI de longa duração: o AI-Q Blueprint agora está pronto para ser executado na Oracle Cloud com segurança de nível empresarial.

NVIDIA otimizou o BEV pooling na GPU para veículos autônomos, robôs e AI espacial
A NVIDIA publicou um guia para acelerar o BEV pooling na GPU — uma operação-chave para a percepção espacial em veículos autônomos, robôs e sistemas de AI espacial.