Editora · verificada pela redação

MarkTechPost

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

290 artigos no Hamidun·Último: 30 de julho· Ativo·marktechpost.com ↗

Últimas publicações

StepFun lança modelo de voz StepAudio 2.5 Realtime com suporte a roleplay
LLMMarkTechPost

StepFun lança modelo de voz StepAudio 2.5 Realtime com suporte a roleplay

O laboratório chinês StepFun apresentou o modelo de voz StepAudio 2.5 Realtime, que supera a concorrência em naturalidade de fala e pode adaptar a voz conforme o cenário do usuário.

25 de mai. de 2026·2 min
Langfuse para Engenheiros de LLM: Pipeline Completo de Rastreamento e Experimentos
LLMMarkTechPost

Langfuse para Engenheiros de LLM: Pipeline Completo de Rastreamento e Experimentos

Langfuse é uma ferramenta para debugging e otimização de aplicações LLM. Aprenda como configurar um pipeline completo de monitoramento, gerenciamento de prompts e experimentos sem modelos pagos.

25 de mai. de 2026·2 min
WorkOS apresenta auth.md — protocolo aberto para registro de agentes de IA
LLMMarkTechPost

WorkOS apresenta auth.md — protocolo aberto para registro de agentes de IA

WorkOS lançou auth.md — padrão aberto que permite agentes de IA se registrarem em aplicativos via arquivo Markdown sem intervenção humana.

25 de mai. de 2026·3 min
ByteDance apresenta Lance: um modelo único para compreensão, geração e edição de vídeo
LLMMarkTechPost

ByteDance apresenta Lance: um modelo único para compreensão, geração e edição de vídeo

ByteDance lançou Lance — um modelo aberto que funciona com imagens e vídeos em um único framework: compreende, gera e edita conteúdo usando apenas 3B de parâmetros ativos.

25 de mai. de 2026·2 min
Cohere lança Command A+: 218 bilhões de parâmetros para agentes em duas GPUs
LLMMarkTechPost

Cohere lança Command A+: 218 bilhões de parâmetros para agentes em duas GPUs

Cohere apresentou o modelo aberto Command A+ com 218 bilhões de parâmetros e capacidades multimodais, rodando em duas GPUs H100 e suportando 48 idiomas.

25 de mai. de 2026·2 min
Perplexity Abre Scanner Bumblebee para Proteger Sistemas de Desenvolvimento
LLMMarkTechPost

Perplexity Abre Scanner Bumblebee para Proteger Sistemas de Desenvolvimento

A Perplexity publicou o código-fonte do Bumblebee, uma ferramenta para verificar vulnerabilidades nas dependências de sistemas de desenvolvimento sem executar nenhum código.

25 de mai. de 2026·2 min
Alibaba apresenta Qwen3.7-Max: agente com contexto de um milhão de tokens
LLMMarkTechPost

Alibaba apresenta Qwen3.7-Max: agente com contexto de um milhão de tokens

Alibaba apresentou Qwen3.7-Max — o modelo-agente mais avançado do Qwen com contexto de 1 milhão de tokens e modo de raciocínio para tarefas complexas multietapas.

25 de mai. de 2026·3 min
CopilotKit redefine a arquitetura para agentes de IA em 2026
LLMMarkTechPost

CopilotKit redefine a arquitetura para agentes de IA em 2026

CopilotKit lançou novo stack para IA agentic: protocolo AG-UI, plataforma AIMock e servidor Pathfinder — solução completa para produção.

25 de mai. de 2026·3 min
OpenMythos: criando transformadores avançados com MLA e GQA no Colab
LLMMarkTechPost

OpenMythos: criando transformadores avançados com MLA e GQA no Colab

OpenMythos permite construir transformadores recorrentes no Google Colab com MLA e GQA. Um tutorial em vídeo verifica a estabilidade através do raio espectral de matrizes de injeção.

25 de mai. de 2026·2 min
Nous Research apresenta CNA: controle do comportamento de LLMs sem retreinamento
LLMMarkTechPost

Nous Research apresenta CNA: controle do comportamento de LLMs sem retreinamento

A Nous Research apresentou o método Contrastive Neuron Attribution (CNA), que permite controlar o comportamento de grandes modelos de linguagem ao encontrar e desativar circuitos neurais individuais sem retreinamento ou

25 de mai. de 2026·3 min
Oito melhores plataformas de autenticação para agentes de IA e MCP em 2026
LLMMarkTechPost

Oito melhores plataformas de autenticação para agentes de IA e MCP em 2026

MCP atingiu 97 milhões de downloads de SDK por mês. Agentes de IA estão migrando massivamente de experimentos para ambientes de produção, e a escolha da plataforma de autenticação correta se tornou…

25 de mai. de 2026·2 min
SuperClaude Framework ajuda a estruturar workflows para Claude API
LLMMarkTechPost

SuperClaude Framework ajuda a estruturar workflows para Claude API

SuperClaude Framework fornece aos desenvolvedores componentes integrados para criar workflows de IA avançados: comandos, agentes, modos de execução e memória de sessão — tudo em um único sistema.

25 de mai. de 2026·2 min
Tencent lança sistema de memória local para agentes de IA TencentDB
LLMMarkTechPost

Tencent lança sistema de memória local para agentes de IA TencentDB

Tencent abriu o código-fonte do TencentDB Agent Memory — um sistema de memória local para agentes de IA que reduz o consumo de tokens em 61% e aumenta a precisão em 28%.

25 de mai. de 2026·3 min
NVIDIA Apresenta Gated DeltaNet-2: Atenção Linear com Portas de Memória Separadas
LLMMarkTechPost

NVIDIA Apresenta Gated DeltaNet-2: Atenção Linear com Portas de Memória Separadas

NVIDIA criou um novo mecanismo de atenção linear, Gated DeltaNet-2, que melhora o gerenciamento de memória em grandes modelos de linguagem através de portas separadas de apagamento e escrita em vez de uma única porta.

25 de mai. de 2026·3 min
Google apresenta Gemini 3.5 Flash: modelo rápido e econômico para codificação e agentes de IA
LLMMarkTechPost

Google apresenta Gemini 3.5 Flash: modelo rápido e econômico para codificação e agentes de IA

No I/O 2026, o Google apresentou o Gemini 3.5 Flash — um modelo 75% mais barato que a versão topo de linha, 4 vezes mais rápido e melhor em codificação e automação.

21 de mai. de 2026·3 min
Alibaba lança tradutor com latência de 2.8 segundos em 60 idiomas
LLMMarkTechPost

Alibaba lança tradutor com latência de 2.8 segundos em 60 idiomas

A Alibaba apresentou um modelo para tradução em tempo real de vídeo e fala simultaneamente em 60 idiomas — com latência mínima e preservação da voz do falante.

21 de mai. de 2026·2 min
NVIDIA apresentou o Nemotron-Labs-Diffusion: um modelo com decodificação tripla
LLMMarkTechPost

NVIDIA apresentou o Nemotron-Labs-Diffusion: um modelo com decodificação tripla

A NVIDIA lançou o modelo de linguagem Nemotron-Labs-Diffusion, que combina três modos de decodificação e processa tokens 6 vezes mais rápido que o Qwen3-8B.

21 de mai. de 2026·2 min
Geração de grafos de conhecimento a partir de texto: um guia prático com kg-gen e NetworkX
LLMMarkTechPost

Geração de grafos de conhecimento a partir de texto: um guia prático com kg-gen e NetworkX

Tutorial sobre a extração automática de entidades e relações de texto com kg-gen, a construção de grafos de conhecimento interativos e sua análise com NetworkX.

21 de mai. de 2026·3 min
Turbovec: índice vetorial em Rust com o algoritmo TurboQuant do Google Research
LLMMarkTechPost

Turbovec: índice vetorial em Rust com o algoritmo TurboQuant do Google Research

O Turbovec usa o algoritmo TurboQuant do Google para comprimir vetores em 16x sem pré-treinamento, simplificando a implantação de aplicações RAG.

21 de mai. de 2026·2 min
As melhores plataformas de AI agêntica em 2026: ranking de Salesforce, Microsoft e outras
LLMMarkTechPost

As melhores plataformas de AI agêntica em 2026: ranking de Salesforce, Microsoft e outras

As empresas estão passando de pilotos para produção. A MarkTechPost compilou um ranking das 10 principais plataformas de AI agêntica: Salesforce Agentforce, Microsoft Copilot Studio, ServiceNow e outras. Preços verificad

19 de mai. de 2026·3 min
NVIDIA desenvolveu um método para treinar redes neurais com precisão de 4-bit
LLMMarkTechPost

NVIDIA desenvolveu um método para treinar redes neurais com precisão de 4-bit

A NVIDIA apresentou o NVFP4, uma metodologia para treinar grandes modelos com precisão de 4-bit em vez da 8-bit padrão, reduzindo o uso de memória pela metade sem perda de qualidade.

19 de mai. de 2026·3 min
OpenAI apresenta o protocolo MRC para redes de supercomputadores com milhões de GPUs
LLMMarkTechPost

OpenAI apresenta o protocolo MRC para redes de supercomputadores com milhões de GPUs

A OpenAI criou um novo protocolo de rede aberto, o MRC, para grandes clusters de AI. Ele distribui dados por centenas de caminhos e se recupera de falhas em microssegundos, permitindo construir supercomputadores com mais

17 de mai. de 2026·3 min
Meta AI apresentou NeuralBench — framework para testar modelos de atividade cerebral
LLMMarkTechPost

Meta AI apresentou NeuralBench — framework para testar modelos de atividade cerebral

A Meta lançou o NeuralBench, um framework aberto para a avaliação padronizada de modelos de AI baseados em EEG, reunindo 36 tarefas, 94 conjuntos de dados e 13,603 horas de registros cerebrais em uma única interface.

17 de mai. de 2026·2 min
Como comprimir um modelo de linguagem em 3x: guia de FP8, GPTQ e SmoothQuant
LLMMarkTechPost

Como comprimir um modelo de linguagem em 3x: guia de FP8, GPTQ e SmoothQuant

Desenvolvedores receberam um guia passo a passo para comprimir grandes modelos de linguagem com llmcompressor, comparando a eficácia da quantização FP8, GPTQ e SmoothQuant para reduzir a carga sobre o hardware.

17 de mai. de 2026·3 min
A OpenAI lançou três modelos de áudio: tradução, transcrição e raciocínio em tempo real
LLMMarkTechPost

A OpenAI lançou três modelos de áudio: tradução, transcrição e raciocínio em tempo real

A OpenAI expandiu a Realtime API com três novos modelos de áudio para processamento de voz: agentes de raciocínio, tradução multilíngue e transcrição em streaming.

17 de mai. de 2026·2 min
Anthropic criou uma ferramenta para traduzir os pensamentos de Claude em linguagem humana
LLMMarkTechPost

Anthropic criou uma ferramenta para traduzir os pensamentos de Claude em linguagem humana

Anthropic desenvolveu Natural Language Autoencoders, uma tecnologia que traduz as ativações internas de Claude em explicações textuais, revelando como a rede neural funciona.

17 de mai. de 2026·2 min
NVIDIA empacotou 3 modelos em um arquivo e tornou o treinamento 360× mais eficiente
LLMMarkTechPost

NVIDIA empacotou 3 modelos em um arquivo e tornou o treinamento 360× mais eficiente

NVIDIA apresentou o Star Elastic, um método que empacota três modelos de tamanhos diferentes em um único checkpoint e permite um treinamento 360× mais eficiente.

17 de mai. de 2026·3 min
NVIDIA lançou cuda-oxide: um compilador de código Rust para GPU
LLMMarkTechPost

NVIDIA lançou cuda-oxide: um compilador de código Rust para GPU

A NVIDIA apresentou o cuda-oxide, uma ferramenta para compilar funções Rust diretamente em código PTX para GPU. Isso simplificará o desenvolvimento de aplicações CUDA em Rust e tornará a computação paralela mais acessíve

17 de mai. de 2026·1 min
NadirClaw: economia em requisições de LLM com roteamento inteligente de prompts
LLMMarkTechPost

NadirClaw: economia em requisições de LLM com roteamento inteligente de prompts

NadirClaw é uma ferramenta de roteamento inteligente de prompts que classifica as requisições como simples ou complexas, encaminhando-as para o modelo adequado para reduzir custos.

17 de mai. de 2026·2 min
Hermes Agent, da Nous Research, assumiu a liderança em consumo de tokens no OpenRouter
LLMMarkTechPost

Hermes Agent, da Nous Research, assumiu a liderança em consumo de tokens no OpenRouter

O agente de AI open-source Hermes Agent, da Nous Research, superou a plataforma de código fechado OpenClaw e assumiu o primeiro lugar no OpenRouter, gerando 224 bilhões de tokens por dia. Isso aconteceu em apenas três me

17 de mai. de 2026·3 min