MarkTechPost
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

StepFun lança modelo de voz StepAudio 2.5 Realtime com suporte a roleplay
O laboratório chinês StepFun apresentou o modelo de voz StepAudio 2.5 Realtime, que supera a concorrência em naturalidade de fala e pode adaptar a voz conforme o cenário do usuário.

Langfuse para Engenheiros de LLM: Pipeline Completo de Rastreamento e Experimentos
Langfuse é uma ferramenta para debugging e otimização de aplicações LLM. Aprenda como configurar um pipeline completo de monitoramento, gerenciamento de prompts e experimentos sem modelos pagos.

WorkOS apresenta auth.md — protocolo aberto para registro de agentes de IA
WorkOS lançou auth.md — padrão aberto que permite agentes de IA se registrarem em aplicativos via arquivo Markdown sem intervenção humana.

ByteDance apresenta Lance: um modelo único para compreensão, geração e edição de vídeo
ByteDance lançou Lance — um modelo aberto que funciona com imagens e vídeos em um único framework: compreende, gera e edita conteúdo usando apenas 3B de parâmetros ativos.

Cohere lança Command A+: 218 bilhões de parâmetros para agentes em duas GPUs
Cohere apresentou o modelo aberto Command A+ com 218 bilhões de parâmetros e capacidades multimodais, rodando em duas GPUs H100 e suportando 48 idiomas.

Perplexity Abre Scanner Bumblebee para Proteger Sistemas de Desenvolvimento
A Perplexity publicou o código-fonte do Bumblebee, uma ferramenta para verificar vulnerabilidades nas dependências de sistemas de desenvolvimento sem executar nenhum código.

Alibaba apresenta Qwen3.7-Max: agente com contexto de um milhão de tokens
Alibaba apresentou Qwen3.7-Max — o modelo-agente mais avançado do Qwen com contexto de 1 milhão de tokens e modo de raciocínio para tarefas complexas multietapas.

CopilotKit redefine a arquitetura para agentes de IA em 2026
CopilotKit lançou novo stack para IA agentic: protocolo AG-UI, plataforma AIMock e servidor Pathfinder — solução completa para produção.

OpenMythos: criando transformadores avançados com MLA e GQA no Colab
OpenMythos permite construir transformadores recorrentes no Google Colab com MLA e GQA. Um tutorial em vídeo verifica a estabilidade através do raio espectral de matrizes de injeção.

Nous Research apresenta CNA: controle do comportamento de LLMs sem retreinamento
A Nous Research apresentou o método Contrastive Neuron Attribution (CNA), que permite controlar o comportamento de grandes modelos de linguagem ao encontrar e desativar circuitos neurais individuais sem retreinamento ou

Oito melhores plataformas de autenticação para agentes de IA e MCP em 2026
MCP atingiu 97 milhões de downloads de SDK por mês. Agentes de IA estão migrando massivamente de experimentos para ambientes de produção, e a escolha da plataforma de autenticação correta se tornou…

SuperClaude Framework ajuda a estruturar workflows para Claude API
SuperClaude Framework fornece aos desenvolvedores componentes integrados para criar workflows de IA avançados: comandos, agentes, modos de execução e memória de sessão — tudo em um único sistema.

Tencent lança sistema de memória local para agentes de IA TencentDB
Tencent abriu o código-fonte do TencentDB Agent Memory — um sistema de memória local para agentes de IA que reduz o consumo de tokens em 61% e aumenta a precisão em 28%.

NVIDIA Apresenta Gated DeltaNet-2: Atenção Linear com Portas de Memória Separadas
NVIDIA criou um novo mecanismo de atenção linear, Gated DeltaNet-2, que melhora o gerenciamento de memória em grandes modelos de linguagem através de portas separadas de apagamento e escrita em vez de uma única porta.

Google apresenta Gemini 3.5 Flash: modelo rápido e econômico para codificação e agentes de IA
No I/O 2026, o Google apresentou o Gemini 3.5 Flash — um modelo 75% mais barato que a versão topo de linha, 4 vezes mais rápido e melhor em codificação e automação.

Alibaba lança tradutor com latência de 2.8 segundos em 60 idiomas
A Alibaba apresentou um modelo para tradução em tempo real de vídeo e fala simultaneamente em 60 idiomas — com latência mínima e preservação da voz do falante.

NVIDIA apresentou o Nemotron-Labs-Diffusion: um modelo com decodificação tripla
A NVIDIA lançou o modelo de linguagem Nemotron-Labs-Diffusion, que combina três modos de decodificação e processa tokens 6 vezes mais rápido que o Qwen3-8B.

Geração de grafos de conhecimento a partir de texto: um guia prático com kg-gen e NetworkX
Tutorial sobre a extração automática de entidades e relações de texto com kg-gen, a construção de grafos de conhecimento interativos e sua análise com NetworkX.

Turbovec: índice vetorial em Rust com o algoritmo TurboQuant do Google Research
O Turbovec usa o algoritmo TurboQuant do Google para comprimir vetores em 16x sem pré-treinamento, simplificando a implantação de aplicações RAG.

As melhores plataformas de AI agêntica em 2026: ranking de Salesforce, Microsoft e outras
As empresas estão passando de pilotos para produção. A MarkTechPost compilou um ranking das 10 principais plataformas de AI agêntica: Salesforce Agentforce, Microsoft Copilot Studio, ServiceNow e outras. Preços verificad

NVIDIA desenvolveu um método para treinar redes neurais com precisão de 4-bit
A NVIDIA apresentou o NVFP4, uma metodologia para treinar grandes modelos com precisão de 4-bit em vez da 8-bit padrão, reduzindo o uso de memória pela metade sem perda de qualidade.

OpenAI apresenta o protocolo MRC para redes de supercomputadores com milhões de GPUs
A OpenAI criou um novo protocolo de rede aberto, o MRC, para grandes clusters de AI. Ele distribui dados por centenas de caminhos e se recupera de falhas em microssegundos, permitindo construir supercomputadores com mais

Meta AI apresentou NeuralBench — framework para testar modelos de atividade cerebral
A Meta lançou o NeuralBench, um framework aberto para a avaliação padronizada de modelos de AI baseados em EEG, reunindo 36 tarefas, 94 conjuntos de dados e 13,603 horas de registros cerebrais em uma única interface.

Como comprimir um modelo de linguagem em 3x: guia de FP8, GPTQ e SmoothQuant
Desenvolvedores receberam um guia passo a passo para comprimir grandes modelos de linguagem com llmcompressor, comparando a eficácia da quantização FP8, GPTQ e SmoothQuant para reduzir a carga sobre o hardware.

A OpenAI lançou três modelos de áudio: tradução, transcrição e raciocínio em tempo real
A OpenAI expandiu a Realtime API com três novos modelos de áudio para processamento de voz: agentes de raciocínio, tradução multilíngue e transcrição em streaming.

Anthropic criou uma ferramenta para traduzir os pensamentos de Claude em linguagem humana
Anthropic desenvolveu Natural Language Autoencoders, uma tecnologia que traduz as ativações internas de Claude em explicações textuais, revelando como a rede neural funciona.

NVIDIA empacotou 3 modelos em um arquivo e tornou o treinamento 360× mais eficiente
NVIDIA apresentou o Star Elastic, um método que empacota três modelos de tamanhos diferentes em um único checkpoint e permite um treinamento 360× mais eficiente.

NVIDIA lançou cuda-oxide: um compilador de código Rust para GPU
A NVIDIA apresentou o cuda-oxide, uma ferramenta para compilar funções Rust diretamente em código PTX para GPU. Isso simplificará o desenvolvimento de aplicações CUDA em Rust e tornará a computação paralela mais acessíve

NadirClaw: economia em requisições de LLM com roteamento inteligente de prompts
NadirClaw é uma ferramenta de roteamento inteligente de prompts que classifica as requisições como simples ou complexas, encaminhando-as para o modelo adequado para reduzir custos.

Hermes Agent, da Nous Research, assumiu a liderança em consumo de tokens no OpenRouter
O agente de AI open-source Hermes Agent, da Nous Research, superou a plataforma de código fechado OpenClaw e assumiu o primeiro lugar no OpenRouter, gerando 224 bilhões de tokens por dia. Isso aconteceu em apenas três me