MarkTechPost
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

Meta AI Apresentou Brain2Qwerty v2 — Decodificador de Texto MEG Não Invasivo com 61% de Precisão
A Meta AI lançou Brain2Qwerty v2 — um pipeline baseado em MEG não invasivo que decodifica sentenças digitadas a partir de sinais cerebrais com 61% de precisão por palavra e publicou o código de treinamento.

Sakana AI Lançou Sakana Marlin — um Agente para Relatórios de 100 Páginas com Slides
Sakana AI Introduziu seu Primeiro Produto Comercial — o Agente Corporativo Marlin, que Funciona Autonomamente por até Oito Horas e Gera Relatórios de até 100 Páginas com Slides

Baidu Desenvolve CUP — Conjunto de Ferramentas Python para Pipelines Backend Confiáveis
MarkTechPost analisou CUP — um conjunto de utilitários Python da Baidu para logging, cache, pools de threads e monitoramento de recursos Linux em um pacote.

Google Research Lança TabFM — Modelo Foundation para Dados Tabulares com Zero-Shot
Google Research apresentou TabFM — um modelo foundation para tabelas que realiza classificação zero-shot e regressão sem treinamento para cada dataset.

Linq Lançou iMessage Apps — Pagamentos, Passagens e Jogos para Agentes de IA Direto na Conversa
A Linq apresentou iMessage Apps — cartões interativos imessage_app para pagamentos, compra de passagens, reserva de voos e jogos dentro do mensageiro.

Claude Sonnet 5 vs Opus 4.8: comparação de codificação agente e preços de API da Anthropic
MarkTechPost comparou Claude Sonnet 5, Sonnet 4.6 e Opus 4.8 da Anthropic: o novo modelo se aproxima do carro-chefe em codificação de agente com preços de token Sonnet mais baixos.

Anthropic retomou operacoes do Claude Fable 5 apos levantamento de restricoes de exportacao dos EUA
Anthropic em 1 de julho de 2026 restaurou acesso ao Claude Fable 5 e introduziu um classificador que bloqueia tecnicas de jailbreak.

OpenAI Lançou GPT-Realtime-2.1 e Versão Mini para Agentes de Voz na API
OpenAI adicionou dois modelos para agentes de voz à sua API—GPT-Realtime-2.1 e GPT-Realtime-2.1-mini—reduzindo latência p95 em pelo menos 25% através de cache.

Tencent lançou Hy3—um modelo MoE aberto com 295 bilhões de parâmetros e contexto 256K
A Tencent apresentou Hy3—um modelo com 295 bilhões de parâmetros, 21 bilhões ativos por token, licença Apache 2.0 e uma pontuação de 78.0 no SWE-Bench Verified.

MarkTechPost mostrou como construir um co-pesquisador de IA QSAR para encontrar inibidores de EGFR
Um tutorial do MarkTechPost ensina como construir um co-pesquisador autônomo de IA usando Random Forest QSAR — de dados ChEMBL e RDKit para moléculas candidatas prontas contra EGFR C797S.

Liquid AI lançou LFM2.5-350M: modelo eficiente de 350M parâmetros com RL em escala
Liquid AI provou que densidade de IA é mais importante que contagem de parâmetros: pequeno modelo pode ser treinado melhor através de aprendizado reforçado.

Parallax: atenção linear local aprimorada com correção de covariância
Pesquisadores do MarkTechPost apresentaram Parallax — uma nova variação do mecanismo de atenção para pequenos LLMs com qualidade e velocidade melhoradas.

MiniMax M3: Novo Modelo com 1M Tokens, Multimodalidade e Computer Use
A empresa apresentou a arquitetura MiniMax Sparse Attention que suporta um milhão de tokens em contexto e trabalha com vídeo, imagens e controle de computador.

Agentes IA autônomos funcionam 50 vezes mais que busca: pesquisa de Harvard e Perplexity
Nova pesquisa de Harvard e Perplexity mostra que agentes IA realizam 26 minutos de trabalho independente por sessão, comparado a 33 segundos para assistentes de busca.

Memory OS: Pilha de Memória de 6 Camadas Aberta para Hermes Agent
Novo projeto Memory OS adiciona memória local persistente ao Hermes Agent através de seis camadas de arquitetura, busca de memória gerenciada e wiki incorporada.

Google lança Gemini 3.5 Live Translate: modelo fala-a-fala para 70+ idiomas
Gemini 3.5 Live Translate traduz fala em tempo real, sintetizando áudio com atraso de alguns segundos. O modelo está disponível na API Gemini Live, Google Meet e aplicativo Google Tradutor.

Nous Research apresentou construtor de perfis Hermes Agent
Nova interface Hermes Agent substitui configuração CLI em múltiplas etapas — usuários agora montam perfis de agentes em um fluxo único no dashboard.

SpaceXAI Lançou Grok 4.5 — Modelo de Código Classe Opus
SpaceXAI apresentou Grok 4.5, modelo classe Opus treinado com Cursor para codificação e tarefas de agente, com preço de $2/$6 por milhão de tokens.

Ant Group Apresentou LingBot-VLA 2.0 — Modelo Aberto para Controlar Robôs de Qualquer Design
Seu modelo de 6 bilhões de parâmetros treinado em 60 mil horas de vídeo de robótica e pode controlar uma dúzia de tipos de manipuladores através de um espaço de ação unificado.

NVIDIA Nemotron-Labs-3-Puzzle-75B: compressão de 37% do modelo dobrou a velocidade do servidor
A NVIDIA lançou uma versão comprimida do LLM Nemotron-3-Super — Nemotron-Labs-3-Puzzle-75B. Graças ao método Puzzle (alternância entre compressão e destilação), o modelo ficou 37% menor e dobrou a taxa de throughput do s

Google Research lançou o SensorFM — modelo para 35 tarefas de previsão de saúde
O Google Research treinou o modelo fundacional SensorFM com 1 trilhão de minutos de dados de 5 milhões de usuários de Fitbit e Pixel Watch para prever condições de saúde.

Robbyant lança LingBot-World-Infinity, modelo causal para mundos interativos
A Robbyant apresentou o LingBot-World-Infinity, um modelo de vídeo de 14B que funciona como simulador interativo e gera vídeo em 720p a 60 quadros por segundo.

Datalab Lift versus concorrentes: como um extrator de 9B funciona com JSON Schema
Datalab comparou sua ferramenta Lift de 9B com NuExtract3, LlamaExtract, Marker e Docling — e analisou quando a abordagem schema-first vence na extração de dados de PDFs.

Liquid AI Lança Antidoom: Método FTPO Reduz Travamentos em Modelos de Reasoning
Liquid AI abriu o código-fonte do Antidoom — uma ferramenta que identifica o token-gatilho de loops infinitos e reentrena apenas ele, reduzindo a frequência de doom-loops de 22,9% para 1%.

Google AI Studio adicionou importação de repositórios do GitHub ao modo de desenvolvimento Build
O Google AI Studio atualizou o modo Build — agora qualquer repositório do GitHub pode ser importado diretamente e transformado de imediato em um app editável e pronto para deploy.

A NVIDIA lançou o Audex-30B — um modelo MoE unificado de áudio e texto baseado no Nemotron-Cascade-2
A NVIDIA reuniu reconhecimento de fala, tradução, síntese de fala e geração de áudio em um único modelo MoE com 30 bilhões de parâmetros, preservando as capacidades de texto do Nemotron-Cascade-2.

Ant Group abre o código-fonte do LingBot-Vision: modelo de 1B para percepção espacial de robôs
Robbyant, da Ant Group, publicou o LingBot-Vision, um modelo ViT de 1B treinado para reconhecer bordas de objetos sem anotação e superar modelos maiores em tarefas de percepção espacial.

IA para Processamento de Documentos PDF: Guia de Ferramentas 2026
Visão geral das ferramentas de código aberto para converter PDFs corporativos e digitalizações em JSON estruturado — essencial para que LLMs e agentes de IA funcionem com dados corporativos reais.

Meituan Lança LongCat-2.0: Modelo MoE Aberto com 1,6 Trilhões de Parâmetros e Contexto de 1 Milhão de Tokens
A empresa chinesa Meituan apresentou LongCat-2.0 — um modelo MoE massivo com janela nativa de um milhão de tokens treinado em ASICs domésticos.

Synthetic Sciences Lança OpenScience — Workbench de IA Aberto para ML, Biologia, Física e Química
OpenScience da Synthetic Sciences — workbench de código aberto sob Apache 2.0 com 250+ habilidades, compatível com qualquer modelo de IA para tarefas em ML, biologia, física e química.