MarkTechPost
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

Sakana AI lança o tradutor Sakana Translate para japonês, inglês e chinês
Sakana AI adicionou ao Sakana Chat o tradutor Sakana Translate baseado em modelos Namazu — com três modos: tradução direta, revisão e diálogo com documentos.

Ajuste fino do Gemma-3 em matemática usando GRPO e adaptadores LoRA
Um fluxo de trabalho GRPO passo a passo para ajustar Gemma-3 no conjunto de dados GSM8K—desde a configuração do ambiente e adaptadores LoRA até funções de recompensa e exportação do modelo final.

Page Agent do Alibaba Gerencia Interfaces Web via DOM Sem Screenshots e Modelos Multimodais
O Alibaba apresentou o Page Agent — um agente JavaScript do lado do cliente que entende comandos em texto e gerencia páginas web via DOM sem screenshots e código do servidor.

Anthropic lança Claude Science Beta: Ambiente multi-agente para genômica e proteômica
Em 30 de junho de 2026, a Anthropic abriu acesso beta ao Claude Science — uma plataforma multi-agente para pipelines reproduzíveis em genômica, proteômica e queminformática.

NVIDIA apresenta ASPIRE — framework de robótica auto-aprendizável com 31% de sucesso zero-shot em tarefas complexas
NVIDIA lançou ASPIRE — um framework para robôs que escreve e melhora programas de controle, acumula soluções verificadas em uma biblioteca de habilidades e as transfere para novas tarefas sem retreinamento.

NVIDIA HORIZON: Agente Autônomo Fecha 100% dos Benchmarks de RTL em Design de Chips
NVIDIA apresentou HORIZON — um agente que escreve e verifica independentemente código RTL para design de chips, alcançando 100% de conclusão nos benchmarks padrão.

Ex-líder técnico do Qwen: por que o raciocínio híbrido falhou e o que vem a seguir
Zunyuan Lin, ex-líder de desenvolvimento do Qwen na Alibaba, explicou onde o raciocínio dinâmico do Qwen3 falhou—e por que a IA agentiva requer uma abordagem de treinamento fundamentalmente diferente.

LlamaIndex lançou legal-kb: busca de documentos com agentes através de quatro ferramentas no Index v2
LlamaIndex publicou a aplicação de referência legal-kb, dando aos agentes acesso tipo arquivo a uma base de conhecimento via retrieve, find, read e grep no mecanismo Index v2.

NVIDIA Lançou Nemotron-Labs-TwoTower — Modelo de Linguagem Difusão com Pesos Abertos
NVIDIA abriu os pesos do modelo de linguagem Nemotron-Labs-TwoTower, que combina um backbone AR congelado com uma cabeça de difusão para acelerar a geração de texto.

Interfaze lançou um modelo ASR de código aberto por difusão para reconhecimento de seis idiomas
Interfaze publicou diffusion-gemma-asr-small — o primeiro adaptador ASR de código aberto sobre a DiffusionGemma do Google: 42 milhões de parâmetros, seis idiomas e custo de inferência atrelado ao número de etapas de remo

WebBrain: agente de AI open-source para navegador funciona sem nuvem e sem assinatura
WebBrain é um agente gratuito sob licença MIT para Chrome e Firefox que lê páginas e automatiza tarefas, rodando localmente via llama.cpp ou Ollama.

Anthropic Lança Claude Fable 5 e Mythos 5: Um Modelo, Dois Níveis de Acesso
Anthropic abriu Fable 5 ao público com classificadores de segurança completos, enquanto Mythos 5—com restrições cibernéticas removidas—é distribuído apenas pelo programa fechado Project Glasswing.

Como acelerar o treinamento de transformers com NVIDIA Apex: FusedAdam, FusedLayerNorm e torch.amp
Guia passo a passo para compilar o NVIDIA Apex a partir do código-fonte e aplicar FusedAdam, FusedLayerNorm e precisão mista — ganho de até 2,5× no treinamento de transformers.

JetBrains lançou a Mellum2 — um modelo MoE aberto de 12B para tarefas rápidas em pipelines de AI
A JetBrains abriu o código da Mellum2 sob Apache 2.0 — um modelo MoE compacto com 12 bilhões de parâmetros, treinado em 10,6 trilhões de tokens para integração em pipelines de AI com múltiplos modelos.

Alibaba lançou o Qwen3.7-Plus: agente multimodal com análise de vídeo e codificação autônoma
A Alibaba lançou na plataforma Bailian o agente multimodal Qwen3.7-Plus — o modelo consegue processar imagens e vídeos, invocar ferramentas e iterar no código por conta própria, sem participação do operador.

PyGraphistry: análise de grafos para detecção de ameaças em dados corporativos
Pesquisadores publicaram um workflow do PyGraphistry no Colab que transforma dados corporativos de acesso em um grafo interativo com anomalias baseadas em ML e três modos de visualização para investigação de incidentes.

Google DeepMind lançou DiffusionGemma — um modelo MoE aberto de 26B com geração 4x mais rápida
Google DeepMind lançou o DiffusionGemma, um modelo aberto experimental de 26B parâmetros que usa difusão de texto em vez de autorregressão — a geração fica até 4x mais rápida na GPU.

Microsoft SkillOpt: otimização automática de prompts em vez de tentativa e erro manual
O Microsoft SkillOpt otimiza prompts de AI por meio de um ciclo automático de seis etapas — reflexão, seleção, validation gating — e mostra ganho mensurável de acurácia já nas primeiras iterações.

North Mini Code da Cohere: modelo MoE open-weight de 30B para codificação com agentes
A Cohere lançou seu primeiro modelo open-weight para desenvolvedores — North Mini Code, com arquitetura MoE, 30B de parâmetros, contexto de 256K e execução em uma única GPU H100.

MiniMax lançou o MSA: atenção esparsa acelera em 28x o processamento de contexto de 1 milhão de tokens
A MiniMax apresentou o MSA, um mecanismo de atenção esparsa de dois ramos, treinado em um modelo MoE de 109 bilhões de parâmetros, que é 28x mais rápido que o GQA padrão em um contexto de 1 milhão de tokens.

Docling Parse: pipeline de parsing de PDF com precisão no nível de caracteres e coordenadas
O tutorial mostra como usar o Docling Parse para análise estrutural de PDF: coordenadas de cada palavra, sobreposições visuais e exportação em JSON e CSV para sistemas RAG.

TimeCopilot: como montar um pipeline de previsão com modelos fundacionais e detecção de anomalias
O TimeCopilot permite montar um ciclo completo de previsão — de modelos estatísticos a modelos fundacionais — com detecção automática de anomalias e um agente LLM que explica as previsões.

Cisco abre o código do FAPO: otimização automática de pipelines de LLM com diagnóstico em cada etapa
A Cisco Foundation AI liberou o FAPO, uma ferramenta baseada no Claude Code que encontra sozinha o elo fraco em uma cadeia de prompts e otimiza o pipeline até atingir a precisão-alvo.

MoonMath AI lança kernel HIP open source para AMD MI300X que supera o AITER v3 oficial
A startup MoonMath AI abriu o código-fonte de um kernel de atenção para AMD MI300X que supera a biblioteca oficial da AMD em todas as formas de tensores e modos de arredondamento.

xAI lança /goal no Grok Build: agente autônomo planeja e verifica tarefas de várias etapas
O Grok Build ganhou o modo /goal: o agente recebe um único objetivo, cria sozinho o plano de execução, avança por uma checklist e verifica o resultado a cada etapa até a conclusão total.

Como montar um agente de AI no Google Colab sem frameworks: tutorial com memória e MCP
Tutorial passo a passo para criar um agente de AI leve no Google Colab — com registro de ferramentas, memória de sessão, skills e servidor MCP, sem frameworks externos.

OpenAI apresenta o GPT-5.6 com três níveis — Sol, Terra e Luna — e modos de raciocínio
A OpenAI anunciou a família GPT-5.6 com três modelos — Sol, Terra e Luna — e novos modos de raciocínio, max e ultra. O acesso por enquanto está limitado a desenvolvedores selecionados.

Perplexity lança Computer for Counsel — agente de AI para equipes jurídicas
A Perplexity lançou um agente de AI especializado para advogados: roteamento por mais de 20 modelos, integração com Microsoft 365 e Midpage, e todas as respostas com links verificáveis para as fontes.

NVIDIA Open-SWE-Traces: preparação de dados para o fine-tuning de agentes de codificação
O tutorial mostra como trabalhar com o dataset NVIDIA Open-SWE-Traces — fazer o parsing das trajetórias dos agentes, analisar patches de código e montar um conjunto SFT para treinar agentes de AI.

DeepSeek lançou DSpark — framework que acelera a geração no DeepSeek-V4 em 57–85%
DeepSeek abriu o código-fonte do DSpark — framework de decodificação especulativa para DeepSeek-V4 que acelera a geração em 57–85% sem perda de qualidade.