Editora · verificada pela redação

MarkTechPost

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

290 artigos no Hamidun·Último: 3 de agosto· Ativo·marktechpost.com ↗

Últimas publicações

Microsoft OpenMementos: como trabalhar com compressão de contexto e dados para treinamento de modelos
LLMMarkTechPost

Microsoft OpenMementos: como trabalhar com compressão de contexto e dados para treinamento de modelos

Uma análise passo a passo do dataset Microsoft OpenMementos mostra como fazer streaming de reasoning traces, analisar blocos e mementos, medir a compressão de contexto e preparar dados para fine-tuning.

1 de mai. de 2026·2 min
Stanford apresentou o OpenJarvis — uma stack de agentes de AI locais com memória e aprendizado
LLMMarkTechPost

Stanford apresentou o OpenJarvis — uma stack de agentes de AI locais com memória e aprendizado

Stanford apresentou o OpenJarvis — uma plataforma para agentes de AI pessoais que rodam diretamente no dispositivo, usam memória e ferramentas e aprendem com dados locais.

30 de abr. de 2026·3 min
Harry Tan lançou o gstack — um sistema de workflow para Claude Code com QA, revisão e release
LLMMarkTechPost

Harry Tan lançou o gstack — um sistema de workflow para Claude Code com QA, revisão e release

Harry Tan abriu o código-fonte do gstack — um conjunto de modos para Claude Code que separa planejamento, revisão, QA e release em comandos distintos e adiciona um navegador persistente.

30 de abr. de 2026·3 min
Zhipu AI lança o GLM-OCR, um modelo OCR compacto de 0,9 bilhão de parâmetros para documentos
LLMMarkTechPost

Zhipu AI lança o GLM-OCR, um modelo OCR compacto de 0,9 bilhão de parâmetros para documentos

A Zhipu AI e a Universidade Tsinghua apresentaram o GLM-OCR, um modelo OCR multimodal de 0,9 bilhão de parâmetros que analisa documentos complexos, tabelas e fórmulas sem depender de escala massiva.

30 de abr. de 2026·3 min
LangChain lançou Deep Agents para agentes de AI em várias etapas com memória e isolamento
LLMMarkTechPost

LangChain lançou Deep Agents para agentes de AI em várias etapas com memória e isolamento

LangChain lançou Deep Agents, uma biblioteca para agentes de AI que precisam de planejamento, memória de longo prazo, contexto de arquivos e isolamento de subagentes em tarefas longas.

30 de abr. de 2026·3 min
IBM lançou Granite 4.0 1B Speech — um modelo de fala multilíngue compacto para edge AI
LLMMarkTechPost

IBM lançou Granite 4.0 1B Speech — um modelo de fala multilíngue compacto para edge AI

A IBM apresentou o Granite 4.0 1B Speech, um modelo leve para reconhecimento e tradução de fala, projetado para implantação rápida em cenários corporativos e de edge com recursos limitados.

30 de abr. de 2026·3 min
Moonshot AI apresentou Attention Residuals — uma alternativa às conexões residuais em transformers
LLMMarkTechPost

Moonshot AI apresentou Attention Residuals — uma alternativa às conexões residuais em transformers

A Moonshot AI propôs Attention Residuals, uma substituição para as conexões residuais padrão em transformers, na qual a camada escolhe sozinha os sinais úteis por meio de attention ao longo da profundidade da rede.

30 de abr. de 2026·3 min
Mistral lançou Small 4 — um modelo MoE de 119 bilhões de parâmetros para reasoning, código e multimodalidade
LLMMarkTechPost

Mistral lançou Small 4 — um modelo MoE de 119 bilhões de parâmetros para reasoning, código e multimodalidade

O novo Mistral Small 4 combina instruct, reasoning, código e imagens em um único modelo MoE open-source de 119 bilhões de parâmetros com contexto de 256k.

30 de abr. de 2026·3 min
Google lançou o WAXAL, um conjunto de dados de fala aberto para línguas africanas
LLMMarkTechPost

Google lançou o WAXAL, um conjunto de dados de fala aberto para línguas africanas

Google tornou público o WAXAL, um grande corpus de fala para línguas africanas que deve acelerar o reconhecimento e a síntese de fala onde ainda havia uma carência crítica de dados abertos.

30 de abr. de 2026·3 min
Nvidia abriu o código do OpenShell, um ambiente seguro para agentes autônomos de AI
LLMMarkTechPost

Nvidia abriu o código do OpenShell, um ambiente seguro para agentes autônomos de AI

A Nvidia lançou o OpenShell em open source: é um ambiente com sandboxes, políticas de acesso e roteamento privado para que agentes autônomos de AI trabalhem com código e rede com mais segurança.

30 de abr. de 2026·3 min
Baidu lança Qianfan-OCR — um modelo 4B para reconhecimento e compreensão de documentos
LLMMarkTechPost

Baidu lança Qianfan-OCR — um modelo 4B para reconhecimento e compreensão de documentos

A Baidu apresentou o Qianfan-OCR, um modelo 4B unificado que analisa a estrutura do documento, reconhece texto e, sob demanda, extrai tabelas ou responde a perguntas.

30 de abr. de 2026·3 min
MarkTechPost mostrou como montar um sistema LLM com autoavaliação, confiança e busca na web
LLMMarkTechPost

MarkTechPost mostrou como montar um sistema LLM com autoavaliação, confiança e busca na web

MarkTechPost apresentou um esquema prático de uncertainty-aware LLM: o modelo primeiro responde e estima sua confiança, depois se revisa e aciona a busca na web quando há dúvida.

30 de abr. de 2026·3 min
GitAgent propõe um formato unificado para agentes de AI em LangChain, AutoGen e Claude Code
LLMMarkTechPost

GitAgent propõe um formato unificado para agentes de AI em LangChain, AutoGen e Claude Code

GitAgent propõe armazenar a lógica, a memória e as regras de um agente de AI em um repositório Git e depois exportar o mesmo agente para LangChain, AutoGen, Claude Code e outros ambientes.

30 de abr. de 2026·3 min
Google lança colab-mcp: como agentes automatizam notebooks Colab em produção
LLMMarkTechPost

Google lança colab-mcp: como agentes automatizam notebooks Colab em produção

Google apresentou um servidor open-source colab-mcp para gerenciar notebooks Colab via MCP: agentes podem adicionar células, executar código e construir workflows resilientes sem rotina manual.

30 de abr. de 2026·3 min
Yann LeCun apresenta LeWorldModel — Modelo JEPA sem colapso de representações a partir de pixels
LLMMarkTechPost

Yann LeCun apresenta LeWorldModel — Modelo JEPA sem colapso de representações a partir de pixels

A equipe de Yann LeCun apresentou LeWorldModel — um world model que aprende diretamente de pixels com duas funções de perda, evita colapso de representações e planeja até 48 vezes mais rápido que alternativas.

30 de abr. de 2026·3 min
HKUDS Apresenta OpenSpace em Detalhes — Motor de Auto-Evolução de Habilidades para Agentes IA
LLMMarkTechPost

HKUDS Apresenta OpenSpace em Detalhes — Motor de Auto-Evolução de Habilidades para Agentes IA

HKUDS demonstrou como OpenSpace transforma agentes IA em sistemas autoaprendizáveis: o motor preserva habilidades após cada tarefa, reutiliza-as e reduz significativamente o consumo de tokens.

30 de abr. de 2026·3 min
Nvidia apresentou PivotRL — um framework para agentes de IA com economia 4x em passos de rollout
LLMMarkTechPost

Nvidia apresentou PivotRL — um framework para agentes de IA com economia 4x em passos de rollout

Nvidia apresentou PivotRL — uma abordagem de ajuste fino para agentes de IA que preserva qualidade fora do domínio de treinamento e atinge precisão comparável ao E2E RL com quatro vezes menos passos de rollout.

30 de abr. de 2026·3 min
Google apresenta TurboQuant: compressão de cache KV de 6x para LLMs sem perda de precisão
LLMMarkTechPost

Google apresenta TurboQuant: compressão de cache KV de 6x para LLMs sem perda de precisão

Google Research apresentou TurboQuant — um algoritmo que comprime o cache KV de grandes modelos de linguagem em pelo menos seis vezes e acelera a computação de atenção em até 8 vezes sem degradação de qualidade.

30 de abr. de 2026·3 min
MolmoWeb-4B da Ai2: Um agente web que vê sites como humanos, sem parsing de HTML
LLMMarkTechPost

MolmoWeb-4B da Ai2: Um agente web que vê sites como humanos, sem parsing de HTML

Ai2 lançou MolmoWeb-4B — um agente web multimodal de código aberto que controla um navegador apenas com screenshots, sem acesso a HTML ou árvore DOM.

30 de abr. de 2026·2 min
Tencent abre o código do Covo-Audio — modelo 7B para diálogos de voz e raciocínio áudio
LLMMarkTechPost

Tencent abre o código do Covo-Audio — modelo 7B para diálogos de voz e raciocínio áudio

O Tencent AI Lab abriu o código aberto do Covo-Audio — um modelo de áudio 7B que aceita fala contínua, responde com voz e visa diálogos e raciocínio em tempo real.

30 de abr. de 2026·2 min
Qwen3.5: Executando Modelos de Reasoning em Formato GGUF e 4-bits via Colab
LLMMarkTechPost

Qwen3.5: Executando Modelos de Reasoning em Formato GGUF e 4-bits via Colab

Um pipeline Colab é apresentado para executar modelos Qwen3.5 de reasoning, destilados no estilo Claude: com uma configuração você pode alternar entre o GGUF de 27B e uma versão leve de 2B de 4-bits.

30 de abr. de 2026·2 min
Google Lança Gemini 3.1 Flash Live para Agentes IA por Voz e Diálogo Multimodal
LLMMarkTechPost

Google Lança Gemini 3.1 Flash Live para Agentes IA por Voz e Diálogo Multimodal

Google abriu acesso de prévia para o Gemini 3.1 Flash Live — um modelo para agentes IA de voz e visuais com baixa latência, suporte a ferramentas e diálogo mais natural.

30 de abr. de 2026·3 min
IWE e OpenAI: Como Transformar Notas em Markdown em um Grafo de Conhecimento para Agentes de IA
LLMMarkTechPost

IWE e OpenAI: Como Transformar Notas em Markdown em um Grafo de Conhecimento para Agentes de IA

Usando IWE como exemplo, mostramos como construir um grafo de conhecimento local a partir de markdown, conectar OpenAI function calling e construir um agentic RAG com travessia de relacionamentos entre notas.

30 de abr. de 2026·2 min
Google explicou a diferença entre Google-Agent e Googlebot para acesso e indexação por IA
LLMMarkTechPost

Google explicou a diferença entre Google-Agent e Googlebot para acesso e indexação por IA

Google descreveu como o novo Google-Agent se diferencia do Googlebot: o primeiro executa ações no site a pedido do usuário, o segundo rastreia automaticamente a web para indexação.

30 de abr. de 2026·2 min
Pesquisadores afiliados à Amazon apresentaram A-Evolve para evolução automática de agentes de IA
LLMMarkTechPost

Pesquisadores afiliados à Amazon apresentaram A-Evolve para evolução automática de agentes de IA

Pesquisadores afiliados à Amazon apresentaram A-Evolve — um sistema que automatiza o desenvolvimento de agentes de IA e substitui a sintonização manual pela evolução de estados e autocorreção.

30 de abr. de 2026·2 min
Agent-Infra Apresenta AIO Sandbox — Ambiente Unificado para Agentes IA com Navegador e Shell
LLMMarkTechPost

Agent-Infra Apresenta AIO Sandbox — Ambiente Unificado para Agentes IA com Navegador e Shell

Agent-Infra lançou AIO Sandbox de código aberto — um ambiente containerizado onde navegador, shell, camada de arquivo compartilhado e MCP estão integrados em um único runtime para agentes IA.

30 de abr. de 2026·2 min
Cursor lança SDK TypeScript para coding-agents com sandboxes em nuvem e cobrança por tokens
LLMMarkTechPost

Cursor lança SDK TypeScript para coding-agents com sandboxes em nuvem e cobrança por tokens

Cursor abriu a versão beta pública do SDK TypeScript: agora desenvolvedores podem executar coding-agents localmente, na nuvem ou em seus próprios workers—com VMs sandboxed, subagents, hooks e cobrança por tokens.

30 de abr. de 2026·3 min
Alibaba lança Qwen3.5-Omni — modelo multimodal nativo para texto, áudio e vídeo
LLMMarkTechPost

Alibaba lança Qwen3.5-Omni — modelo multimodal nativo para texto, áudio e vídeo

A Alibaba apresentou Qwen3.5-Omni — um modelo omnimodal nativo que compreende texto, imagens, áudio e vídeo em uma única arquitetura e consegue responder com voz em tempo real.

30 de abr. de 2026·3 min
OpenAI Lançou Privacy Filter: Modelo Aberto para Remover Dados Pessoais
LLMMarkTechPost

OpenAI Lançou Privacy Filter: Modelo Aberto para Remover Dados Pessoais

OpenAI publicou Privacy Filter — um modelo open-source para detecção e substituição automática de dados pessoais, funcionando diretamente no navegador sem infraestrutura de servidor.

30 de abr. de 2026·2 min
OpenAI e Promptflow: Como Construir um Pipeline LLM com Rastreamento e Avaliação de Qualidade
LLMMarkTechPost

OpenAI e Promptflow: Como Construir um Pipeline LLM com Rastreamento e Avaliação de Qualidade

O guia mostra como construir um pipeline LLM no Google Colab usando Promptflow, Prompty e OpenAI com configuração segura de chaves, rastreamento de execuções e avaliação de qualidade integrada.

30 de abr. de 2026·3 min