MarkTechPost
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

Meta tornou o Astryx open-source — sistema de design em React com suporte a agentes de AI e MCP
A Meta lançou o Astryx — um sistema de design open-source em React e StyleX com servidor MCP e CLI, no qual engenheiros e agentes de AI trabalham por uma API única com os mesmos componentes. *A Meta é reconhecida como or

A Liquid AI lançou o LFM2.5-230M: 213 tokens/s no Galaxy S25 e suporte a llama.cpp
A Liquid AI lançou o LFM2.5-230M, um modelo aberto de 230 milhões de parâmetros que roda offline em smartphone e Raspberry Pi, superando concorrentes quatro vezes maiores em capacidade de seguir instruções.

Datalab lança lift, modelo de 9 bilhões de parâmetros com pesos abertos para extrair JSON de PDFs
A Datalab abriu o código do lift, um modelo visual de 9 bilhões de parâmetros que converte PDFs e imagens em JSON estruturado conforme um esquema definido, atingindo 90,2% de precisão por campo em um benchmark de 225 doc

Z.ai lança GLM-5.2: um milhão real de tokens e dois níveis de raciocínio profundo
Z.ai lançou o GLM-5.2 com uma janela de contexto realmente funcional de 1 milhão de tokens, modos High e Max, e suporte para Claude Code, Cline e OpenClaw através de uma API compatível com Anthropic.

FineWeb sem baixar terabytes: streaming, filtragem e tokenização de corpus web para LLM
Um guia prático de FineWeb do Hugging Face: como trabalhar com um corpus web de múltiplos terabytes para treinamento de LLM através de streaming, filtragem, deduplicação e tokenização — sem baixar completamente os dados.

Zyphra lançou Zamba2-VL: modelos visuais com resposta 10x mais rápida
Zyphra lançou Zamba2-VL — VLMs abertos com 1,2B, 2,7B e 7B parâmetros com arquitetura híbrida Mamba2 + Transformer, que reduz o tempo até o primeiro token em aproximadamente 10 vezes.

Moonshot AI lança Kimi Work — agente de desktop com enxame de 300 subagentes
Kimi Work da Moonshot AI funciona localmente em macOS e Windows, controla o navegador via WebBridge e coordena um enxame de até 300 subagentes paralelos.

Claude Code 2026: Análise Completa de 25 Funcionalidades da Ferramenta Agentiva com Exemplos
MarkTechPost lançou um guia sobre Claude Code 2026 com análise de 25 funcionalidades — de CLAUDE.md e skills até MCP, hooks e Auto Mode — com exemplos de código e demo.

Google lança Gemini-SQL2: Gemini 3.1 Pro atinge 80% no benchmark BIRD
O Google Research apresentou Gemini-SQL2 baseado em Gemini 3.1 Pro — o modelo alcançou 80,04% de acurácia no benchmark BIRD para conversão de texto em SQL.

Como Construir um Espaço de Trabalho para Agentes no QwenPaw com Habilidades Customizadas e API de Streaming
Tutorial passo a passo para implantação do QwenPaw — um framework para criar agentes de IA com suporte a múltiplos provedores de modelos, habilidades customizadas e API de streaming no Google Colab.

Moonshot AI lança Kimi K2.7-Code: ganho de 21,8% no Code Bench v2 sobre K2.6
Moonshot AI liberou o código-fonte do Kimi K2.7-Code — um modelo de codificação agencial com contexto de 256K e consumo 30% menor de tokens de raciocínio em comparação com K2.6.

Comparação de modelos TTS 2026: de comerciais a abertos
Em 2026, a escolha do modelo TTS depende de três fatores: qualidade do som, latência de processamento e custo. Soluções comerciais vencem em naturalidade, soluções abertas em controle e custo.

StepFun apresenta Step 3.7 Flash — modelo Vision-Language com 198 bilhões de parâmetros
A StepFun lançou o Step 3.7 Flash, um novo modelo multimodal com 198 bilhões de parâmetros, visão integrada, janela de contexto de 256 mil tokens e modo Advisor para agentes de código.

NVIDIA X-Token: destilação que supera o GOLD em 3,82 pontos
A NVIDIA lançou o X-Token, um método de destilação de conhecimento para modelos pequenos (Llama-3.2-1B) que supera o GOLD em 3,82 pontos e melhora a precisão em matemática de 2,56 para 15,54%.

AgentTrove: como usar o dataset de 1,7 milhão de rastros de agentes em Python
AgentTrove é o maior dataset aberto de rastros de interação de agentes: 1,7 milhão de exemplos no formato ShareGPT. Um tutorial em Python mostra como fazer streaming dos dados, normalizar as ações dos agentes e preparar

Nous Research lançou o Tool Search para o Hermes Agent: a precisão aumentou 49–74% no Opus 4
A Nous Research resolveu o problema do inchaço de contexto no MCP ao adicionar uma busca inteligente de ferramentas. O sistema seleciona apenas os esquemas relevantes e aumenta a precisão em dezenas de por cento ao traba

Genesis AI lança Genesis World 1.0 — plataforma para avaliar robôs 400 vezes mais rápido
Genesis AI lançou a plataforma Genesis World 1.0 para simulação de robôs, que reduz o tempo de avaliação de 200 horas para 30 minutos e reproduz o comportamento real com 90% de fidelidade.

NVIDIA lançou Polar — framework para treinamento de agentes de código
NVIDIA criou Polar — framework para treinamento de agentes de linguagem através de aprendizado por reforço, que melhorou o desempenho no SWE-Bench em 22,6 pontos no ambiente Codex.

UC Berkeley criou mKernel: uma biblioteca unificada para sincronização de GPU em clusters
UC Berkeley lançou mKernel — uma nova biblioteca CUDA para sincronizar milhares de GPUs em data centers, combinando comunicação local e remota em um único kernel persistente.

Stability AI lança Stable Audio 3 para geração rápida de música
Stability AI apresentou Stable Audio 3 — modelos para geração de música e efeitos sonoros que funcionam em MacBook e GPUs de consumidor com 8GB VRAM.

ZeroEntropy apresenta Zerank-2 — um reranqueador leve para busca precisa
ZeroEntropy lançou o Zerank-2, um compacto cross-encoder baseado em Qwen3, que melhora significativamente a qualidade da busca em sistemas RAG de dois estágios.

Sakana AI apresentou DiffusionBlocks: método para treinar redes neurais em blocos
A Sakana AI apresentou DiffusionBlocks — um novo método que permite treinar camadas de redes residuais independentemente uma da outra, interpretando atualizações como difusão reversa.

Busca vetorial em PostgreSQL: guia completo do pgvector para aplicações de IA
PostgreSQL tornou-se um concorrente sério das bases de dados vetoriais especializadas graças à extensão pgvector.

Perplexity AI Lança Tokenizador 5x Mais Rápido que o Padrão Hugging Face
A Perplexity AI lançou um tokenizador Unigram reescrito que acelera o processamento de texto 5x e reduz a carga de CPU em 5-6x em ambientes de produção.

Cientistas criam MEMO — framework para expandir a memória de LLMs sem retreinamento
Pesquisadores propõem MEMO — um framework que permite que LLMs aprendam com novos dados sem retreinar o modelo principal, usando um módulo de memória separado.

EAGLE 3.1: como corrigir a instabilidade da decodificação especulativa em LLMs
O lançamento conjunto do EAGLE team, vLLM e TorchSpec corrige o problema crítico de drift de atenção na decodificação especulativa, que desacelerava a inferência de LLMs em produção.

Anthropic Lançou Claude Opus 4.8 com Workflows Dinâmicos e Fast Mode Mais Barato
Anthropic apresentou o Claude Opus 4.8 com workflows dinâmicos e um fast mode mais acessível. A atualização está disponível na prévia de pesquisa do Claude Code.

Liquid AI lançou LFM2.5-8B: modelo MoE compacto com contexto de 128K
A Liquid AI apresentou o novo modelo LFM2.5-8B-A1B — um modelo MoE econômico que ativa apenas 1,5B de 8,3B parâmetros. Funciona em PCs convencionais com contexto de 128K.

Hexo Labs publica SIA — um agente que se atualiza durante sua execução
Hexo Labs lançou o código aberto da SIA, um sistema que se auto-aperfeiçoa atualizando tanto as instruções do agente quanto os pesos de sua rede neural.

Microsoft Research lança Webwright — agente de navegador que resolve tarefas web em 60%
Microsoft Research apresentou Webwright — um agente de navegador que executa tarefas web complexas melhor do que grandes modelos de linguagem: 60% de sucesso no benchmark Odysseys contra 33,5% para o GPT-5.4 base.