Editora · verificada pela redação

Hugging Face Blog

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

65 artigos no Hamidun·Último: 30 de julho· Ativo·huggingface.co ↗

Últimas publicações

IBM lançou Granite Embedding R2 — um modelo multilíngue para busca semântica
LLMHugging Face Blog

IBM lançou Granite Embedding R2 — um modelo multilíngue para busca semântica

A IBM apresentou Granite Embedding R2, um modelo multilíngue aberto para busca semântica com suporte a contexto de 32K e melhor desempenho da categoria entre modelos sub-100M.

16 de mai. de 2026·3 min
H Company lançou Holotron-12B — um modelo para agentes com aumento de velocidade de 2x
LLMHugging Face Blog

H Company lançou Holotron-12B — um modelo para agentes com aumento de velocidade de 2x

A H Company publicou Holotron-12B no Hugging Face: o modelo multimodal para agentes de AI entrega mais do que o dobro de throughput em tarefas de uso de interfaces em um único H100.

2 de mai. de 2026·3 min
NVIDIA apresentou SPEED-Bench — um benchmark unificado para speculative decoding
LLMHugging Face Blog

NVIDIA apresentou SPEED-Bench — um benchmark unificado para speculative decoding

A NVIDIA publicou SPEED-Bench, um conjunto de dados e um framework de medição que compara speculative decoding em cargas reais, contextos longos e diferentes motores de inferência.

2 de mai. de 2026·3 min
IBM lançou Mellea 0.4.0 e Granite Libraries para pipelines de AI verificáveis
LLMHugging Face Blog

IBM lançou Mellea 0.4.0 e Granite Libraries para pipelines de AI verificáveis

A IBM Research atualizou o framework de código aberto Mellea para a versão 0.4.0 e lançou três Granite Libraries para fluxos de trabalho de AI estruturados, verificáveis e seguros.

2 de mai. de 2026·3 min
NVIDIA mostrou como fazer fine-tuning de um modelo de embedding para um domínio específico em um dia
LLMHugging Face Blog

NVIDIA mostrou como fazer fine-tuning de um modelo de embedding para um domínio específico em um dia

NVIDIA e Hugging Face publicaram um passo a passo que transforma, em poucas horas, um modelo de embedding base em uma busca especializada em documentos internos.

2 de mai. de 2026·3 min
ServiceNow apresentou EVA — um novo framework para avaliar agentes de voz com AI
LLMHugging Face Blog

ServiceNow apresentou EVA — um novo framework para avaliar agentes de voz com AI

A ServiceNow lançou o EVA — um sistema que avalia agentes de voz com AI não só pelo sucesso na tarefa, mas também pela qualidade do diálogo, da concisão das respostas ao tempo das falas.

2 de mai. de 2026·3 min
IBM lança Granite 4.0 3B Vision para extrair dados de documentos e gráficos
LLMHugging Face Blog

IBM lança Granite 4.0 3B Vision para extrair dados de documentos e gráficos

IBM apresentou Granite 4.0 3B Vision, um modelo multimodal compacto para extrair tabelas, gráficos e campos-chave de documentos, que pode ser integrado a pipelines corporativos com Docling.

2 de mai. de 2026·2 min
H Company apresenta Holo3 — um agente de AI para usar o computador com pontuação recorde no OSWorld-Verified
LLMHugging Face Blog

H Company apresenta Holo3 — um agente de AI para usar o computador com pontuação recorde no OSWorld-Verified

A H Company lançou o Holo3, um modelo para usar o computador que alcançou 78,85% no OSWorld-Verified e foi treinado com cenários corporativos sintéticos.

2 de mai. de 2026·3 min
Google lançou o Gemma 4 no Hugging Face: modelos multimodais para execução local
LLMHugging Face Blog

Google lançou o Gemma 4 no Hugging Face: modelos multimodais para execução local

O Google DeepMind abriu a família Gemma 4 no Hugging Face: quatro modelos multimodais com licença Apache 2.0, contexto de até 256K e execução do celular à estação de trabalho.

2 de mai. de 2026·3 min
Hugging Face adicionou gradio.Server: agora é possível conectar um frontend próprio ao backend do Gradio
LLMHugging Face Blog

Hugging Face adicionou gradio.Server: agora é possível conectar um frontend próprio ao backend do Gradio

O novo gradio.Server da Hugging Face transforma o Gradio em uma camada de backend para React, Svelte e HTML/JS puro, mantendo filas de requisições, ZeroGPU e compatibilidade com Spaces.

2 de mai. de 2026·3 min
Hugging Face transfere o Safetensors para a PyTorch Foundation para uma governança neutra do formato
LLMHugging Face Blog

Hugging Face transfere o Safetensors para a PyTorch Foundation para uma governança neutra do formato

A Hugging Face anunciou que o Safetensors passou a ser um projeto da PyTorch Foundation: não há mudanças incompatíveis para os usuários, enquanto o desenvolvimento do formato passa para um modelo de governança neutra.

2 de mai. de 2026·3 min
Overworld lançou o Waypoint-1.5: mundos interativos em 720p para GPUs de consumo
LLMHugging Face Blog

Overworld lançou o Waypoint-1.5: mundos interativos em 720p para GPUs de consumo

A Overworld lançou o Waypoint-1.5, uma world model para execução local em GPUs de consumo: até 720p e 60 FPS, além de uma versão 360p mais leve para uma gama mais ampla de PCs e notebooks.

2 de mai. de 2026·3 min
Hugging Face lançou uma Skill para portar rapidamente modelos do Transformers para MLX
LLMHugging Face Blog

Hugging Face lançou uma Skill para portar rapidamente modelos do Transformers para MLX

A Hugging Face apresentou uma Skill e um test harness separado para portar novos modelos do Transformers para o mlx-lm no MLX quase de imediato, sem um fluxo de PRs brutos gerados por AI.

2 de mai. de 2026·3 min
IBM Research analisou onde agentes de AI falham com APIs, documentos e regras no VAKRA
LLMHugging Face Blog

IBM Research analisou onde agentes de AI falham com APIs, documentos e regras no VAKRA

A análise do VAKRA pela IBM Research mostra que até modelos fortes perdem confiabilidade quando precisam combinar APIs, documentos, raciocínio em múltiplas etapas e restrições de ferramentas.

2 de mai. de 2026·3 min
Hugging Face publicou o Ecom-RLVE, um ambiente de treinamento para agentes de AI de e-commerce
LLMHugging Face Blog

Hugging Face publicou o Ecom-RLVE, um ambiente de treinamento para agentes de AI de e-commerce

Hugging Face publicou o Ecom-RLVE, um ambiente open-source em que agentes de AI aprendem a conduzir diálogos de compra, usar ferramentas e receber uma recompensa verificável pelo carrinho que realmente montam.

2 de mai. de 2026·3 min
TII apresentou o QIMMA — um leaderboard de LLMs árabes com verificação da qualidade dos benchmarks
LLMHugging Face Blog

TII apresentou o QIMMA — um leaderboard de LLMs árabes com verificação da qualidade dos benchmarks

A TII lançou o QIMMA, um leaderboard de LLMs árabes que primeiro verifica os próprios benchmarks e só depois compara os modelos em 52 mil exemplos de sete domínios.

2 de mai. de 2026·3 min
A NVIDIA apresentou o Nemotron OCR v2: OCR multilíngue treinado com 12,2 milhões de documentos sintéticos
LLMHugging Face Blog

A NVIDIA apresentou o Nemotron OCR v2: OCR multilíngue treinado com 12,2 milhões de documentos sintéticos

A NVIDIA mostrou como desenvolveu o Nemotron OCR v2: o modelo foi treinado com 12,2 milhões de documentos sintéticos para reconhecer vários idiomas com um único motor e processar até 34,7 páginas por segundo.

2 de mai. de 2026·3 min
NVIDIA mostrou como Gemma 4 com voz e webcam roda no Jetson Orin Nano Super
LLMHugging Face Blog

NVIDIA mostrou como Gemma 4 com voz e webcam roda no Jetson Orin Nano Super

A NVIDIA publicou uma demo em que Gemma 4 decide sozinho quando acionar a webcam e responde por voz — tudo localmente no Jetson Orin Nano Super com 8 GB de memória.

1 de mai. de 2026·3 min
NVIDIA apresenta o NeMo Retriever — busca agêntica para dados corporativos complexos
LLMHugging Face Blog

NVIDIA apresenta o NeMo Retriever — busca agêntica para dados corporativos complexos

A NVIDIA apresentou um pipeline agêntico no NeMo Retriever: o sistema não se limita à busca semântica, mas planeja etapas, refina consultas e já alcançou o primeiro lugar no ViDoRe v3.

30 de abr. de 2026·3 min
Nvidia apresentou o primeiro dataset aberto e modelos fundacionais de AI para robôs médicos
LLMHugging Face Blog

Nvidia apresentou o primeiro dataset aberto e modelos fundacionais de AI para robôs médicos

A Nvidia e seus parceiros no Hugging Face abriram o primeiro grande dataset para robôs médicos e lançaram dois modelos fundacionais para cirurgia, simulação e autonomia futura.

30 de abr. de 2026·3 min
NVIDIA lançou Nemotron 3 Nano 4B — um modelo híbrido compacto para execução em dispositivos
LLMHugging Face Blog

NVIDIA lançou Nemotron 3 Nano 4B — um modelo híbrido compacto para execução em dispositivos

A NVIDIA tornou disponível o modelo Nemotron 3 Nano 4B com arquitetura híbrida Mamba-Transformer: o menor uso de VRAM da categoria, 18 tokens/s no Jetson Orin Nano e pesos abertos.

30 de abr. de 2026·2 min
Hugging Face: modelos open-source chineses superam os EUA em downloads no ecossistema de AI
LLMHugging Face Blog

Hugging Face: modelos open-source chineses superam os EUA em downloads no ecossistema de AI

A Hugging Face mostrou que o AI open-source quase dobrou de escala em um ano, enquanto os modelos chineses já respondem por 41% dos downloads e ditam o ritmo de lançamentos, adaptação e implantação local.

30 de abr. de 2026·3 min
Avaliação de Modelos de IA Ficou Mais Cara que Seu Treinamento — Novo Obstáculo para Pesquisadores
LLMHugging Face Blog

Avaliação de Modelos de IA Ficou Mais Cara que Seu Treinamento — Novo Obstáculo para Pesquisadores

EvalEval Coalition analisou o custo dos benchmarks de IA: um teste agêntico único custa $40.000 ou mais, e grupos acadêmicos não podem mais arcar com avaliação independente.

30 de abr. de 2026·2 min
IBM revela como construiu Granite 4.1: 15 trilhões de tokens, contexto de 512K e foco na qualidade
LLMHugging Face Blog

IBM revela como construiu Granite 4.1: 15 trilhões de tokens, contexto de 512K e foco na qualidade

IBM detalhou sua abordagem para treinar Granite 4.1: cinco etapas de pré-treinamento, 15 trilhões de tokens, janela de contexto até 512K e pipelines separados de SFT e RL para melhoria de qualidade.

30 de abr. de 2026·3 min
Hugging Face adiciona DeepInfra aos Inference Providers para executar modelos via API unificada
LLMHugging Face Blog

Hugging Face adiciona DeepInfra aos Inference Providers para executar modelos via API unificada

Hugging Face conectou DeepInfra aos Inference Providers: modelos DeepSeek, Kimi e GLM agora podem ser executados a partir das páginas do Hub, via SDK e através do roteador unificado sem integração separada.

30 de abr. de 2026·3 min
NVIDIA apresentou Nemotron 3 Nano Omni para documentos longos, áudio, vídeo e agentes de IA
LLMHugging Face Blog

NVIDIA apresentou Nemotron 3 Nano Omni para documentos longos, áudio, vídeo e agentes de IA

NVIDIA apresentou o Nemotron 3 Nano Omni — um modelo multimodal aberto para documentos longos, áudio, vídeo e cenários de GUI com foco em velocidade e contexto.

28 de abr. de 2026·3 min
Hugging Face Explica Fine-tuning de Embeddings Multimodais e Modelos Reranker
LLMHugging Face Blog

Hugging Face Explica Fine-tuning de Embeddings Multimodais e Modelos Reranker

Hugging Face lançou um guia prático sobre treinamento de modelos de embedding e reranker multimodais em Sentence Transformers e demonstrou como o fine-tuning específico de domínio melhora a recuperação de documentos.

28 de abr. de 2026·3 min
Como Hugging Face Constrói Aplicações Web Escaláveis com Privacy Filter do OpenAI
LLMHugging Face Blog

Como Hugging Face Constrói Aplicações Web Escaláveis com Privacy Filter do OpenAI

Hugging Face demonstrou três cenários para OpenAI Privacy Filter: leitura de documentos com destaque de PII, anonimização de imagens e pastebin seguro com versões pública e privada.

27 de abr. de 2026·3 min
Hugging Face: AI de código aberto dá aos defensores as mesmas capacidades que aos atacantes
LLMHugging Face Blog

Hugging Face: AI de código aberto dá aos defensores as mesmas capacidades que aos atacantes

A Hugging Face explica por que modelos e ferramentas abertos são uma vantagem estrutural na cibersegurança, e não uma ameaça.

22 de abr. de 2026·2 min
Hugging Face treinou um modelo de geração de imagens em 24 horas
LLMHugging Face Blog

Hugging Face treinou um modelo de geração de imagens em 24 horas

A terceira parte do projeto PRX, da Hugging Face, demonstra que é possível treinar um modelo text-to-image completo em apenas 24 horas. Isso muda a percepção sobre a acessibilidade do AI generativo.

3 de mar. de 2026·2 min