Editora · verificada pela redação

MarkTechPost

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

290 artigos no Hamidun·Último: 3 de agosto· Ativo·marktechpost.com ↗

Últimas publicações

Sakana AI lança o tradutor Sakana Translate para japonês, inglês e chinês
LLMMarkTechPost

Sakana AI lança o tradutor Sakana Translate para japonês, inglês e chinês

Sakana AI adicionou ao Sakana Chat o tradutor Sakana Translate baseado em modelos Namazu — com três modos: tradução direta, revisão e diálogo com documentos.

6 de jul. de 2026·2 min
Ajuste fino do Gemma-3 em matemática usando GRPO e adaptadores LoRA
LLMMarkTechPost

Ajuste fino do Gemma-3 em matemática usando GRPO e adaptadores LoRA

Um fluxo de trabalho GRPO passo a passo para ajustar Gemma-3 no conjunto de dados GSM8K—desde a configuração do ambiente e adaptadores LoRA até funções de recompensa e exportação do modelo final.

6 de jul. de 2026·3 min
Page Agent do Alibaba Gerencia Interfaces Web via DOM Sem Screenshots e Modelos Multimodais
LLMMarkTechPost

Page Agent do Alibaba Gerencia Interfaces Web via DOM Sem Screenshots e Modelos Multimodais

O Alibaba apresentou o Page Agent — um agente JavaScript do lado do cliente que entende comandos em texto e gerencia páginas web via DOM sem screenshots e código do servidor.

6 de jul. de 2026·2 min
Anthropic lança Claude Science Beta: Ambiente multi-agente para genômica e proteômica
LLMMarkTechPost

Anthropic lança Claude Science Beta: Ambiente multi-agente para genômica e proteômica

Em 30 de junho de 2026, a Anthropic abriu acesso beta ao Claude Science — uma plataforma multi-agente para pipelines reproduzíveis em genômica, proteômica e queminformática.

5 de jul. de 2026·2 min
NVIDIA apresenta ASPIRE — framework de robótica auto-aprendizável com 31% de sucesso zero-shot em tarefas complexas
LLMMarkTechPost

NVIDIA apresenta ASPIRE — framework de robótica auto-aprendizável com 31% de sucesso zero-shot em tarefas complexas

NVIDIA lançou ASPIRE — um framework para robôs que escreve e melhora programas de controle, acumula soluções verificadas em uma biblioteca de habilidades e as transfere para novas tarefas sem retreinamento.

5 de jul. de 2026·2 min
NVIDIA HORIZON: Agente Autônomo Fecha 100% dos Benchmarks de RTL em Design de Chips
LLMMarkTechPost

NVIDIA HORIZON: Agente Autônomo Fecha 100% dos Benchmarks de RTL em Design de Chips

NVIDIA apresentou HORIZON — um agente que escreve e verifica independentemente código RTL para design de chips, alcançando 100% de conclusão nos benchmarks padrão.

5 de jul. de 2026·2 min
Ex-líder técnico do Qwen: por que o raciocínio híbrido falhou e o que vem a seguir
LLMMarkTechPost

Ex-líder técnico do Qwen: por que o raciocínio híbrido falhou e o que vem a seguir

Zunyuan Lin, ex-líder de desenvolvimento do Qwen na Alibaba, explicou onde o raciocínio dinâmico do Qwen3 falhou—e por que a IA agentiva requer uma abordagem de treinamento fundamentalmente diferente.

5 de jul. de 2026·2 min
LlamaIndex lançou legal-kb: busca de documentos com agentes através de quatro ferramentas no Index v2
LLMMarkTechPost

LlamaIndex lançou legal-kb: busca de documentos com agentes através de quatro ferramentas no Index v2

LlamaIndex publicou a aplicação de referência legal-kb, dando aos agentes acesso tipo arquivo a uma base de conhecimento via retrieve, find, read e grep no mecanismo Index v2.

5 de jul. de 2026·2 min
NVIDIA Lançou Nemotron-Labs-TwoTower — Modelo de Linguagem Difusão com Pesos Abertos
LLMMarkTechPost

NVIDIA Lançou Nemotron-Labs-TwoTower — Modelo de Linguagem Difusão com Pesos Abertos

NVIDIA abriu os pesos do modelo de linguagem Nemotron-Labs-TwoTower, que combina um backbone AR congelado com uma cabeça de difusão para acelerar a geração de texto.

4 de jul. de 2026·2 min
Interfaze lançou um modelo ASR de código aberto por difusão para reconhecimento de seis idiomas
LLMMarkTechPost

Interfaze lançou um modelo ASR de código aberto por difusão para reconhecimento de seis idiomas

Interfaze publicou diffusion-gemma-asr-small — o primeiro adaptador ASR de código aberto sobre a DiffusionGemma do Google: 42 milhões de parâmetros, seis idiomas e custo de inferência atrelado ao número de etapas de remo

3 de jul. de 2026·2 min
WebBrain: agente de AI open-source para navegador funciona sem nuvem e sem assinatura
LLMMarkTechPost

WebBrain: agente de AI open-source para navegador funciona sem nuvem e sem assinatura

WebBrain é um agente gratuito sob licença MIT para Chrome e Firefox que lê páginas e automatiza tarefas, rodando localmente via llama.cpp ou Ollama.

3 de jul. de 2026·2 min
Anthropic Lança Claude Fable 5 e Mythos 5: Um Modelo, Dois Níveis de Acesso
LLMMarkTechPost

Anthropic Lança Claude Fable 5 e Mythos 5: Um Modelo, Dois Níveis de Acesso

Anthropic abriu Fable 5 ao público com classificadores de segurança completos, enquanto Mythos 5—com restrições cibernéticas removidas—é distribuído apenas pelo programa fechado Project Glasswing.

30 de jun. de 2026·3 min
Como acelerar o treinamento de transformers com NVIDIA Apex: FusedAdam, FusedLayerNorm e torch.amp
LLMMarkTechPost

Como acelerar o treinamento de transformers com NVIDIA Apex: FusedAdam, FusedLayerNorm e torch.amp

Guia passo a passo para compilar o NVIDIA Apex a partir do código-fonte e aplicar FusedAdam, FusedLayerNorm e precisão mista — ganho de até 2,5× no treinamento de transformers.

30 de jun. de 2026·2 min
JetBrains lançou a Mellum2 — um modelo MoE aberto de 12B para tarefas rápidas em pipelines de AI
LLMMarkTechPost

JetBrains lançou a Mellum2 — um modelo MoE aberto de 12B para tarefas rápidas em pipelines de AI

A JetBrains abriu o código da Mellum2 sob Apache 2.0 — um modelo MoE compacto com 12 bilhões de parâmetros, treinado em 10,6 trilhões de tokens para integração em pipelines de AI com múltiplos modelos.

30 de jun. de 2026·2 min
Alibaba lançou o Qwen3.7-Plus: agente multimodal com análise de vídeo e codificação autônoma
LLMMarkTechPost

Alibaba lançou o Qwen3.7-Plus: agente multimodal com análise de vídeo e codificação autônoma

A Alibaba lançou na plataforma Bailian o agente multimodal Qwen3.7-Plus — o modelo consegue processar imagens e vídeos, invocar ferramentas e iterar no código por conta própria, sem participação do operador.

30 de jun. de 2026·2 min
PyGraphistry: análise de grafos para detecção de ameaças em dados corporativos
LLMMarkTechPost

PyGraphistry: análise de grafos para detecção de ameaças em dados corporativos

Pesquisadores publicaram um workflow do PyGraphistry no Colab que transforma dados corporativos de acesso em um grafo interativo com anomalias baseadas em ML e três modos de visualização para investigação de incidentes.

30 de jun. de 2026·2 min
Google DeepMind lançou DiffusionGemma — um modelo MoE aberto de 26B com geração 4x mais rápida
LLMMarkTechPost

Google DeepMind lançou DiffusionGemma — um modelo MoE aberto de 26B com geração 4x mais rápida

Google DeepMind lançou o DiffusionGemma, um modelo aberto experimental de 26B parâmetros que usa difusão de texto em vez de autorregressão — a geração fica até 4x mais rápida na GPU.

30 de jun. de 2026·2 min
Microsoft SkillOpt: otimização automática de prompts em vez de tentativa e erro manual
LLMMarkTechPost

Microsoft SkillOpt: otimização automática de prompts em vez de tentativa e erro manual

O Microsoft SkillOpt otimiza prompts de AI por meio de um ciclo automático de seis etapas — reflexão, seleção, validation gating — e mostra ganho mensurável de acurácia já nas primeiras iterações.

30 de jun. de 2026·2 min
North Mini Code da Cohere: modelo MoE open-weight de 30B para codificação com agentes
LLMMarkTechPost

North Mini Code da Cohere: modelo MoE open-weight de 30B para codificação com agentes

A Cohere lançou seu primeiro modelo open-weight para desenvolvedores — North Mini Code, com arquitetura MoE, 30B de parâmetros, contexto de 256K e execução em uma única GPU H100.

30 de jun. de 2026·2 min
MiniMax lançou o MSA: atenção esparsa acelera em 28x o processamento de contexto de 1 milhão de tokens
LLMMarkTechPost

MiniMax lançou o MSA: atenção esparsa acelera em 28x o processamento de contexto de 1 milhão de tokens

A MiniMax apresentou o MSA, um mecanismo de atenção esparsa de dois ramos, treinado em um modelo MoE de 109 bilhões de parâmetros, que é 28x mais rápido que o GQA padrão em um contexto de 1 milhão de tokens.

30 de jun. de 2026·2 min
Docling Parse: pipeline de parsing de PDF com precisão no nível de caracteres e coordenadas
LLMMarkTechPost

Docling Parse: pipeline de parsing de PDF com precisão no nível de caracteres e coordenadas

O tutorial mostra como usar o Docling Parse para análise estrutural de PDF: coordenadas de cada palavra, sobreposições visuais e exportação em JSON e CSV para sistemas RAG.

30 de jun. de 2026·3 min
TimeCopilot: como montar um pipeline de previsão com modelos fundacionais e detecção de anomalias
LLMMarkTechPost

TimeCopilot: como montar um pipeline de previsão com modelos fundacionais e detecção de anomalias

O TimeCopilot permite montar um ciclo completo de previsão — de modelos estatísticos a modelos fundacionais — com detecção automática de anomalias e um agente LLM que explica as previsões.

29 de jun. de 2026·2 min
Cisco abre o código do FAPO: otimização automática de pipelines de LLM com diagnóstico em cada etapa
LLMMarkTechPost

Cisco abre o código do FAPO: otimização automática de pipelines de LLM com diagnóstico em cada etapa

A Cisco Foundation AI liberou o FAPO, uma ferramenta baseada no Claude Code que encontra sozinha o elo fraco em uma cadeia de prompts e otimiza o pipeline até atingir a precisão-alvo.

29 de jun. de 2026·3 min
MoonMath AI lança kernel HIP open source para AMD MI300X que supera o AITER v3 oficial
LLMMarkTechPost

MoonMath AI lança kernel HIP open source para AMD MI300X que supera o AITER v3 oficial

A startup MoonMath AI abriu o código-fonte de um kernel de atenção para AMD MI300X que supera a biblioteca oficial da AMD em todas as formas de tensores e modos de arredondamento.

29 de jun. de 2026·2 min
xAI lança /goal no Grok Build: agente autônomo planeja e verifica tarefas de várias etapas
LLMMarkTechPost

xAI lança /goal no Grok Build: agente autônomo planeja e verifica tarefas de várias etapas

O Grok Build ganhou o modo /goal: o agente recebe um único objetivo, cria sozinho o plano de execução, avança por uma checklist e verifica o resultado a cada etapa até a conclusão total.

29 de jun. de 2026·2 min
Como montar um agente de AI no Google Colab sem frameworks: tutorial com memória e MCP
LLMMarkTechPost

Como montar um agente de AI no Google Colab sem frameworks: tutorial com memória e MCP

Tutorial passo a passo para criar um agente de AI leve no Google Colab — com registro de ferramentas, memória de sessão, skills e servidor MCP, sem frameworks externos.

28 de jun. de 2026·2 min
OpenAI apresenta o GPT-5.6 com três níveis — Sol, Terra e Luna — e modos de raciocínio
LLMMarkTechPost

OpenAI apresenta o GPT-5.6 com três níveis — Sol, Terra e Luna — e modos de raciocínio

A OpenAI anunciou a família GPT-5.6 com três modelos — Sol, Terra e Luna — e novos modos de raciocínio, max e ultra. O acesso por enquanto está limitado a desenvolvedores selecionados.

28 de jun. de 2026·2 min
Perplexity lança Computer for Counsel — agente de AI para equipes jurídicas
LLMMarkTechPost

Perplexity lança Computer for Counsel — agente de AI para equipes jurídicas

A Perplexity lançou um agente de AI especializado para advogados: roteamento por mais de 20 modelos, integração com Microsoft 365 e Midpage, e todas as respostas com links verificáveis para as fontes.

28 de jun. de 2026·2 min
NVIDIA Open-SWE-Traces: preparação de dados para o fine-tuning de agentes de codificação
LLMMarkTechPost

NVIDIA Open-SWE-Traces: preparação de dados para o fine-tuning de agentes de codificação

O tutorial mostra como trabalhar com o dataset NVIDIA Open-SWE-Traces — fazer o parsing das trajetórias dos agentes, analisar patches de código e montar um conjunto SFT para treinar agentes de AI.

28 de jun. de 2026·2 min
DeepSeek lançou DSpark — framework que acelera a geração no DeepSeek-V4 em 57–85%
LLMMarkTechPost

DeepSeek lançou DSpark — framework que acelera a geração no DeepSeek-V4 em 57–85%

DeepSeek abriu o código-fonte do DSpark — framework de decodificação especulativa para DeepSeek-V4 que acelera a geração em 57–85% sem perda de qualidade.

28 de jun. de 2026·2 min