Editora · verificada pela redação

MarkTechPost

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

290 artigos no Hamidun·Último: 3 de agosto· Ativo·marktechpost.com ↗

Últimas publicações

Meta tornou o Astryx open-source — sistema de design em React com suporte a agentes de AI e MCP
LLMMarkTechPost

Meta tornou o Astryx open-source — sistema de design em React com suporte a agentes de AI e MCP

A Meta lançou o Astryx — um sistema de design open-source em React e StyleX com servidor MCP e CLI, no qual engenheiros e agentes de AI trabalham por uma API única com os mesmos componentes. *A Meta é reconhecida como or

28 de jun. de 2026·2 min
A Liquid AI lançou o LFM2.5-230M: 213 tokens/s no Galaxy S25 e suporte a llama.cpp
LLMMarkTechPost

A Liquid AI lançou o LFM2.5-230M: 213 tokens/s no Galaxy S25 e suporte a llama.cpp

A Liquid AI lançou o LFM2.5-230M, um modelo aberto de 230 milhões de parâmetros que roda offline em smartphone e Raspberry Pi, superando concorrentes quatro vezes maiores em capacidade de seguir instruções.

28 de jun. de 2026·2 min
Datalab lança lift, modelo de 9 bilhões de parâmetros com pesos abertos para extrair JSON de PDFs
LLMMarkTechPost

Datalab lança lift, modelo de 9 bilhões de parâmetros com pesos abertos para extrair JSON de PDFs

A Datalab abriu o código do lift, um modelo visual de 9 bilhões de parâmetros que converte PDFs e imagens em JSON estruturado conforme um esquema definido, atingindo 90,2% de precisão por campo em um benchmark de 225 doc

28 de jun. de 2026·3 min
Z.ai lança GLM-5.2: um milhão real de tokens e dois níveis de raciocínio profundo
LLMMarkTechPost

Z.ai lança GLM-5.2: um milhão real de tokens e dois níveis de raciocínio profundo

Z.ai lançou o GLM-5.2 com uma janela de contexto realmente funcional de 1 milhão de tokens, modos High e Max, e suporte para Claude Code, Cline e OpenClaw através de uma API compatível com Anthropic.

15 de jun. de 2026·2 min
FineWeb sem baixar terabytes: streaming, filtragem e tokenização de corpus web para LLM
LLMMarkTechPost

FineWeb sem baixar terabytes: streaming, filtragem e tokenização de corpus web para LLM

Um guia prático de FineWeb do Hugging Face: como trabalhar com um corpus web de múltiplos terabytes para treinamento de LLM através de streaming, filtragem, deduplicação e tokenização — sem baixar completamente os dados.

15 de jun. de 2026·3 min
Zyphra lançou Zamba2-VL: modelos visuais com resposta 10x mais rápida
LLMMarkTechPost

Zyphra lançou Zamba2-VL: modelos visuais com resposta 10x mais rápida

Zyphra lançou Zamba2-VL — VLMs abertos com 1,2B, 2,7B e 7B parâmetros com arquitetura híbrida Mamba2 + Transformer, que reduz o tempo até o primeiro token em aproximadamente 10 vezes.

15 de jun. de 2026·2 min
Moonshot AI lança Kimi Work — agente de desktop com enxame de 300 subagentes
LLMMarkTechPost

Moonshot AI lança Kimi Work — agente de desktop com enxame de 300 subagentes

Kimi Work da Moonshot AI funciona localmente em macOS e Windows, controla o navegador via WebBridge e coordena um enxame de até 300 subagentes paralelos.

15 de jun. de 2026·2 min
Claude Code 2026: Análise Completa de 25 Funcionalidades da Ferramenta Agentiva com Exemplos
LLMMarkTechPost

Claude Code 2026: Análise Completa de 25 Funcionalidades da Ferramenta Agentiva com Exemplos

MarkTechPost lançou um guia sobre Claude Code 2026 com análise de 25 funcionalidades — de CLAUDE.md e skills até MCP, hooks e Auto Mode — com exemplos de código e demo.

15 de jun. de 2026·2 min
Google lança Gemini-SQL2: Gemini 3.1 Pro atinge 80% no benchmark BIRD
LLMMarkTechPost

Google lança Gemini-SQL2: Gemini 3.1 Pro atinge 80% no benchmark BIRD

O Google Research apresentou Gemini-SQL2 baseado em Gemini 3.1 Pro — o modelo alcançou 80,04% de acurácia no benchmark BIRD para conversão de texto em SQL.

15 de jun. de 2026·3 min
Como Construir um Espaço de Trabalho para Agentes no QwenPaw com Habilidades Customizadas e API de Streaming
LLMMarkTechPost

Como Construir um Espaço de Trabalho para Agentes no QwenPaw com Habilidades Customizadas e API de Streaming

Tutorial passo a passo para implantação do QwenPaw — um framework para criar agentes de IA com suporte a múltiplos provedores de modelos, habilidades customizadas e API de streaming no Google Colab.

15 de jun. de 2026·3 min
Moonshot AI lança Kimi K2.7-Code: ganho de 21,8% no Code Bench v2 sobre K2.6
LLMMarkTechPost

Moonshot AI lança Kimi K2.7-Code: ganho de 21,8% no Code Bench v2 sobre K2.6

Moonshot AI liberou o código-fonte do Kimi K2.7-Code — um modelo de codificação agencial com contexto de 256K e consumo 30% menor de tokens de raciocínio em comparação com K2.6.

15 de jun. de 2026·3 min
Comparação de modelos TTS 2026: de comerciais a abertos
LLMMarkTechPost

Comparação de modelos TTS 2026: de comerciais a abertos

Em 2026, a escolha do modelo TTS depende de três fatores: qualidade do som, latência de processamento e custo. Soluções comerciais vencem em naturalidade, soluções abertas em controle e custo.

31 de mai. de 2026·3 min
StepFun apresenta Step 3.7 Flash — modelo Vision-Language com 198 bilhões de parâmetros
LLMMarkTechPost

StepFun apresenta Step 3.7 Flash — modelo Vision-Language com 198 bilhões de parâmetros

A StepFun lançou o Step 3.7 Flash, um novo modelo multimodal com 198 bilhões de parâmetros, visão integrada, janela de contexto de 256 mil tokens e modo Advisor para agentes de código.

31 de mai. de 2026·3 min
NVIDIA X-Token: destilação que supera o GOLD em 3,82 pontos
LLMMarkTechPost

NVIDIA X-Token: destilação que supera o GOLD em 3,82 pontos

A NVIDIA lançou o X-Token, um método de destilação de conhecimento para modelos pequenos (Llama-3.2-1B) que supera o GOLD em 3,82 pontos e melhora a precisão em matemática de 2,56 para 15,54%.

31 de mai. de 2026·2 min
AgentTrove: como usar o dataset de 1,7 milhão de rastros de agentes em Python
LLMMarkTechPost

AgentTrove: como usar o dataset de 1,7 milhão de rastros de agentes em Python

AgentTrove é o maior dataset aberto de rastros de interação de agentes: 1,7 milhão de exemplos no formato ShareGPT. Um tutorial em Python mostra como fazer streaming dos dados, normalizar as ações dos agentes e preparar

31 de mai. de 2026·2 min
Nous Research lançou o Tool Search para o Hermes Agent: a precisão aumentou 49–74% no Opus 4
LLMMarkTechPost

Nous Research lançou o Tool Search para o Hermes Agent: a precisão aumentou 49–74% no Opus 4

A Nous Research resolveu o problema do inchaço de contexto no MCP ao adicionar uma busca inteligente de ferramentas. O sistema seleciona apenas os esquemas relevantes e aumenta a precisão em dezenas de por cento ao traba

31 de mai. de 2026·2 min
Genesis AI lança Genesis World 1.0 — plataforma para avaliar robôs 400 vezes mais rápido
LLMMarkTechPost

Genesis AI lança Genesis World 1.0 — plataforma para avaliar robôs 400 vezes mais rápido

Genesis AI lançou a plataforma Genesis World 1.0 para simulação de robôs, que reduz o tempo de avaliação de 200 horas para 30 minutos e reproduz o comportamento real com 90% de fidelidade.

31 de mai. de 2026·2 min
NVIDIA lançou Polar — framework para treinamento de agentes de código
LLMMarkTechPost

NVIDIA lançou Polar — framework para treinamento de agentes de código

NVIDIA criou Polar — framework para treinamento de agentes de linguagem através de aprendizado por reforço, que melhorou o desempenho no SWE-Bench em 22,6 pontos no ambiente Codex.

29 de mai. de 2026·2 min
UC Berkeley criou mKernel: uma biblioteca unificada para sincronização de GPU em clusters
LLMMarkTechPost

UC Berkeley criou mKernel: uma biblioteca unificada para sincronização de GPU em clusters

UC Berkeley lançou mKernel — uma nova biblioteca CUDA para sincronizar milhares de GPUs em data centers, combinando comunicação local e remota em um único kernel persistente.

29 de mai. de 2026·2 min
Stability AI lança Stable Audio 3 para geração rápida de música
LLMMarkTechPost

Stability AI lança Stable Audio 3 para geração rápida de música

Stability AI apresentou Stable Audio 3 — modelos para geração de música e efeitos sonoros que funcionam em MacBook e GPUs de consumidor com 8GB VRAM.

29 de mai. de 2026·2 min
ZeroEntropy apresenta Zerank-2 — um reranqueador leve para busca precisa
LLMMarkTechPost

ZeroEntropy apresenta Zerank-2 — um reranqueador leve para busca precisa

ZeroEntropy lançou o Zerank-2, um compacto cross-encoder baseado em Qwen3, que melhora significativamente a qualidade da busca em sistemas RAG de dois estágios.

29 de mai. de 2026·2 min
Sakana AI apresentou DiffusionBlocks: método para treinar redes neurais em blocos
LLMMarkTechPost

Sakana AI apresentou DiffusionBlocks: método para treinar redes neurais em blocos

A Sakana AI apresentou DiffusionBlocks — um novo método que permite treinar camadas de redes residuais independentemente uma da outra, interpretando atualizações como difusão reversa.

29 de mai. de 2026·3 min
Busca vetorial em PostgreSQL: guia completo do pgvector para aplicações de IA
LLMMarkTechPost

Busca vetorial em PostgreSQL: guia completo do pgvector para aplicações de IA

PostgreSQL tornou-se um concorrente sério das bases de dados vetoriais especializadas graças à extensão pgvector.

29 de mai. de 2026·3 min
Perplexity AI Lança Tokenizador 5x Mais Rápido que o Padrão Hugging Face
LLMMarkTechPost

Perplexity AI Lança Tokenizador 5x Mais Rápido que o Padrão Hugging Face

A Perplexity AI lançou um tokenizador Unigram reescrito que acelera o processamento de texto 5x e reduz a carga de CPU em 5-6x em ambientes de produção.

29 de mai. de 2026·3 min
Cientistas criam MEMO — framework para expandir a memória de LLMs sem retreinamento
LLMMarkTechPost

Cientistas criam MEMO — framework para expandir a memória de LLMs sem retreinamento

Pesquisadores propõem MEMO — um framework que permite que LLMs aprendam com novos dados sem retreinar o modelo principal, usando um módulo de memória separado.

29 de mai. de 2026·3 min
EAGLE 3.1: como corrigir a instabilidade da decodificação especulativa em LLMs
LLMMarkTechPost

EAGLE 3.1: como corrigir a instabilidade da decodificação especulativa em LLMs

O lançamento conjunto do EAGLE team, vLLM e TorchSpec corrige o problema crítico de drift de atenção na decodificação especulativa, que desacelerava a inferência de LLMs em produção.

29 de mai. de 2026·2 min
Anthropic Lançou Claude Opus 4.8 com Workflows Dinâmicos e Fast Mode Mais Barato
LLMMarkTechPost

Anthropic Lançou Claude Opus 4.8 com Workflows Dinâmicos e Fast Mode Mais Barato

Anthropic apresentou o Claude Opus 4.8 com workflows dinâmicos e um fast mode mais acessível. A atualização está disponível na prévia de pesquisa do Claude Code.

29 de mai. de 2026·3 min
Liquid AI lançou LFM2.5-8B: modelo MoE compacto com contexto de 128K
LLMMarkTechPost

Liquid AI lançou LFM2.5-8B: modelo MoE compacto com contexto de 128K

A Liquid AI apresentou o novo modelo LFM2.5-8B-A1B — um modelo MoE econômico que ativa apenas 1,5B de 8,3B parâmetros. Funciona em PCs convencionais com contexto de 128K.

29 de mai. de 2026·2 min
Hexo Labs publica SIA — um agente que se atualiza durante sua execução
LLMMarkTechPost

Hexo Labs publica SIA — um agente que se atualiza durante sua execução

Hexo Labs lançou o código aberto da SIA, um sistema que se auto-aperfeiçoa atualizando tanto as instruções do agente quanto os pesos de sua rede neural.

29 de mai. de 2026·1 min
Microsoft Research lança Webwright — agente de navegador que resolve tarefas web em 60%
LLMMarkTechPost

Microsoft Research lança Webwright — agente de navegador que resolve tarefas web em 60%

Microsoft Research apresentou Webwright — um agente de navegador que executa tarefas web complexas melhor do que grandes modelos de linguagem: 60% de sucesso no benchmark Odysseys contra 33,5% para o GPT-5.4 base.

25 de mai. de 2026·2 min