Editora · verificada pela redação

MarkTechPost

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

292 artigos no Hamidun·Último: 3 de agosto· Ativo·marktechpost.com ↗

Últimas publicações

SmolAgents: Como Construir um Sistema de IA Multi-Agente com Código e Orquestração Dinâmica
LLMMarkTechPost

SmolAgents: Como Construir um Sistema de IA Multi-Agente com Código e Orquestração Dinâmica

Uma análise da implementação do SmolAgents mostra como agentes de IA leves executam código, invocam ferramentas, trabalham com memória e coordenam tarefas dentro de um único sistema.

28 de abr. de 2026·2 min
NetKet e JAX: como construir um modelo Transformer para sistemas de spins frustrados
LLMMarkTechPost

NetKet e JAX: como construir um modelo Transformer para sistemas de spins frustrados

O guia mostra como construir um pipeline de VMC de pesquisa usando NetKet, JAX e arquitetura Transformer para modelar uma cadeia de spin frustrada J1-J2.

28 de abr. de 2026·3 min
OpenAI apresentou GPT-Rosalind — um modelo de IA para biologia, genômica e desenvolvimento de medicamentos
LLMMarkTechPost

OpenAI apresentou GPT-Rosalind — um modelo de IA para biologia, genômica e desenvolvimento de medicamentos

OpenAI lançou GPT-Rosalind — um modelo especializado para biologia e farmacêutica que ajuda a acelerar o desenvolvimento de medicamentos, análise de dados genômicos e planejamento de experimentos.

28 de abr. de 2026·3 min
Google apresentou Auto-Diagnose — sistema de IA para encontrar causas de falhas em testes de integração
LLMMarkTechPost

Google apresentou Auto-Diagnose — sistema de IA para encontrar causas de falhas em testes de integração

Google apresentou Auto-Diagnose — um sistema baseado em Gemini 2.5 Flash que analisa automaticamente logs de testes de integração com falha e identifica a causa raiz da falha com 90,14% de precisão.

28 de abr. de 2026·3 min
OpenAI GPT-OSS: Lançando Modelos Open-Weight no Colab com MXFP4 e Inferência Avançada
LLMMarkTechPost

OpenAI GPT-OSS: Lançando Modelos Open-Weight no Colab com MXFP4 e Inferência Avançada

Um novo guia explica como lançar openai/gpt-oss-20b no Google Colab: instalar dependências para Transformers, verificar GPU, ativar quantização MXFP4 e construir um pipeline de inferência funcional.

27 de abr. de 2026·3 min
Anthropic lança Claude Opus 4.7 para programação de agentes, visão e tarefas autônomas
LLMMarkTechPost

Anthropic lança Claude Opus 4.7 para programação de agentes, visão e tarefas autônomas

Anthropic apresentou Claude Opus 4.7 — uma atualização do modelo de referência com melhorias notáveis em codificação de agentes, análise de imagens detalhadas e tarefas autônomas longas.

27 de abr. de 2026·3 min
PrismML Bonsai: Como executar um modelo 1-bit em CUDA com GGUF, JSON e RAG
LLMMarkTechPost

PrismML Bonsai: Como executar um modelo 1-bit em CUDA com GGUF, JSON e RAG

Em um novo tutorial de PrismML Bonsai, cobrimos como executar Bonsai-1.7B em GPU via CUDA e GGUF, medir throughput, configurar chat, saída JSON rigorosa e um cenário RAG básico.

27 de abr. de 2026·2 min
xAI lança APIs Grok separadas para reconhecimento e síntese de fala para desenvolvedores corporativos
LLMMarkTechPost

xAI lança APIs Grok separadas para reconhecimento e síntese de fala para desenvolvedores corporativos

xAI separou a pilha de voz do Grok em APIs autônomas: Speech-to-Text e Text-to-Speech para negócios com preços agressivos, suporte multilíngue e foco no mercado de aplicações de voz.

27 de abr. de 2026·3 min
NVIDIA lançou Ising — a primeira família aberta de modelos de IA para sistemas quântico-clássicos
LLMMarkTechPost

NVIDIA lançou Ising — a primeira família aberta de modelos de IA para sistemas quântico-clássicos

NVIDIA apresentou Ising — uma família aberta de modelos de IA para calibração de processadores quânticos e correção de erros, para trazer sistemas híbridos quântico-clássicos úteis mais próximos à realidade.

27 de abr. de 2026·3 min
Por que LoRA quebra em produção e como RS-LoRA salva o ajuste fino de modelos
LLMMarkTechPost

Por que LoRA quebra em produção e como RS-LoRA salva o ajuste fino de modelos

LoRA funciona bem com estilo e formato, mas perde sinal ao ajustar com novos fatos; RS-LoRA resolve o problema mudando a fórmula de escalonamento para uma mais estável.

27 de abr. de 2026·3 min
OpenKB e OpenRouter mostram como construir uma base de conhecimento IA local com busca em Llama
LLMMarkTechPost

OpenKB e OpenRouter mostram como construir uma base de conhecimento IA local com busca em Llama

Um novo tutorial explica como implantar uma base de conhecimento local no OpenKB, conectar um modelo aberto via OpenRouter e configurar a busca com segurança sem codificar chaves.

27 de abr. de 2026·2 min
OpenAI e Magika mostraram como construir um pipeline para reconhecimento de arquivos e análise de ameaças
LLMMarkTechPost

OpenAI e Magika mostraram como construir um pipeline para reconhecimento de arquivos e análise de ameaças

O guia demonstra um pipeline prático onde Magika determina o tipo real do arquivo a partir de bytes, e OpenAI ajuda a interpretar o resultado e identificar riscos potenciais.

27 de abr. de 2026·2 min
Meta apresentou Sapiens2 — um modelo unificado de visão computacional para pose, segmentação e 3D
LLMMarkTechPost

Meta apresentou Sapiens2 — um modelo unificado de visão computacional para pose, segmentação e 3D

Meta Reality Labs lançou Sapiens2 — uma família de modelos de visão para análise humana que resolve pose, segmentação, geometria de superfície e mapeamento 3D a partir de uma única arquitetura.

27 de abr. de 2026·3 min
OpenMOSS lança MOSS-Audio — modelo de áudio aberto que supera alternativas maiores
LLMMarkTechPost

OpenMOSS lança MOSS-Audio — modelo de áudio aberto que supera alternativas maiores

OpenMOSS apresentou MOSS-Audio — um modelo aberto que compreende fala, música e sons ambientes em uma única arquitetura e supera modelos open-source significativamente maiores em benchmarks de áudio comuns.

27 de abr. de 2026·2 min
Embeddings OpenAI e RL: Como Construir um Agente com Memória de Longo Prazo para Respostas Precisas
LLMMarkTechPost

Embeddings OpenAI e RL: Como Construir um Agente com Memória de Longo Prazo para Respostas Precisas

O tutorial mostra como treinar um agente RL para selecionar registros relevantes da memória de longo prazo, de forma que uma LLM responda com mais precisão perguntas sobre fatos armazenados.

27 de abr. de 2026·2 min
Como Medir a Inteligência Real: Principais Benchmarks para Agentes de IA
LLMMarkTechPost

Como Medir a Inteligência Real: Principais Benchmarks para Agentes de IA

Testes clássicos não refletem mais as capacidades reais das redes neurais. Exploramos quais benchmarks realmente mostram se um agente de IA está pronto para aplicações comerciais no mundo real.

26 de abr. de 2026·2 min
Memória Elástica para IA: Como kvcached Resolve a Escassez de GPU
LLMMarkTechPost

Memória Elástica para IA: Como kvcached Resolve a Escassez de GPU

A distribuição dinâmica de cache KV promete reduzir drasticamente o custo de hospedagem de modelos de linguagem, permitindo o compartilhamento eficiente de memória de uma única GPU.

26 de abr. de 2026·3 min
Modelo de Voz da xAI Supera GPT Realtime em Tarefas Empresariais
LLMMarkTechPost

Modelo de Voz da xAI Supera GPT Realtime em Tarefas Empresariais

A empresa de Elon Musk, xAI, apresentou o grok-voice-think-fast-1.0. O novo modelo superou soluções da OpenAI e Google no gerenciamento de fluxos de trabalho empresariais complexos.

26 de abr. de 2026·2 min
GitNexus: Como uma nova ferramenta ensinou agentes IA a compreender estruturalmente o código
LLMMarkTechPost

GitNexus: Como uma nova ferramenta ensinou agentes IA a compreender estruturalmente o código

Assistentes de IA são excelentes em escrever código local, mas frequentemente não conseguem entender a arquitetura global de projetos. O projeto open-source GitNexus resolve este problema usando grafos de conhecimento e

26 de abr. de 2026·3 min
DeepSeek-V4: Como novos algoritmos de compressão tornaram o contexto de um milhão de tokens uma realidade
LLMMarkTechPost

DeepSeek-V4: Como novos algoritmos de compressão tornaram o contexto de um milhão de tokens uma realidade

A DeepSeek apresentou a quarta geração de seus modelos. Através da compressão radical de atenção, o processamento de enormes volumes de dados está se tornando acessível não apenas para gigantes da tecnologia.

26 de abr. de 2026·3 min
Arquitetura Decoupled DiLoCo do DeepMind Resolve Problema de Escalabilidade da IA
LLMMarkTechPost

Arquitetura Decoupled DiLoCo do DeepMind Resolve Problema de Escalabilidade da IA

O treinamento de modelos avançados de IA sempre foi refém de falhas de hardware: a quebra de um chip paralisava todo o cluster. Uma nova arquitetura do Google DeepMind muda as regras do jogo.

26 de abr. de 2026·2 min
OpenMythos: reconstrução open-source da arquitetura Claude Mythos em PyTorch com 770M parâmetros
LLMMarkTechPost

OpenMythos: reconstrução open-source da arquitetura Claude Mythos em PyTorch com 770M parâmetros

O desenvolvedor Kye Gomez reconstruiu a presumida arquitetura Claude Mythos da Anthropic do zero — sem vazamentos, apenas com base em pesquisa pública.

23 de abr. de 2026·2 min
OpenAI Expande GPT-5.4-Cyber para Profissionais Verificados de Segurança Cibernética
LLMMarkTechPost

OpenAI Expande GPT-5.4-Cyber para Profissionais Verificados de Segurança Cibernética

OpenAI abre acesso amplo ao GPT-5.4-Cyber — uma versão refinada do GPT-5.4 sem restrições padrão para milhares de defensores verificados.

23 de abr. de 2026·2 min
Moonshot AI lança Kimi K2.6: modelo agêntico com um enxame de 300 subagentes
LLMMarkTechPost

Moonshot AI lança Kimi K2.6: modelo agêntico com um enxame de 300 subagentes

O laboratório chinês Moonshot AI abriu o código-fonte do Kimi K2.6, um modelo agêntico multimodal que coordena autonomamente até 300 subagentes e 4.000 etapas.

23 de abr. de 2026·2 min
Phi-4-Mini da Microsoft: implementação de quantização, RAG e LoRA em um único notebook Jupyter
LLMMarkTechPost

Phi-4-Mini da Microsoft: implementação de quantização, RAG e LoRA em um único notebook Jupyter

O tutorial mostra o pipeline completo com o Phi-4-mini-instruct: quantização de 4 bits, geração em streaming, raciocínio, chamada de ferramentas, RAG e LoRA fine-tuning em um único notebook.

23 de abr. de 2026·2 min
Qwen 3.6-35B-A3B na prática: multimodalidade, MoE e RAG em um único pipeline
LLMMarkTechPost

Qwen 3.6-35B-A3B na prática: multimodalidade, MoE e RAG em um único pipeline

Uma análise detalhada da implementação do Qwen 3.6-35B-A3B, do carregamento do modelo a RAG, tool calling e persistência de sessões em fluxos de trabalho reais.

22 de abr. de 2026·2 min
NVIDIA apresentou o Nemotron 3 Super — um modelo aberto com 120 bilhões de parâmetros
LLMMarkTechPost

NVIDIA apresentou o Nemotron 3 Super — um modelo aberto com 120 bilhões de parâmetros

O novo modelo híbrido combina as arquiteturas Mamba e Attention com a abordagem Mixture-of-Experts, garantindo um ganho de desempenho de 5x para sistemas multiagentes. A distância entre modelos proprietários e abertos es

11 de mar. de 2026·2 min
Google apresentou TensorFlow 2.21 e LiteRT para AI móvel
LLMMarkTechPost

Google apresentou TensorFlow 2.21 e LiteRT para AI móvel

Google apresentou TensorFlow 2.21 e LiteRT, um novo padrão para executar redes neurais em smartphones com suporte a NPU e aceleração por GPU para plataformas móveis.

7 de mar. de 2026·2 min
Google lança Android Bench para avaliar a IA no desenvolvimento mobile
LLMMarkTechPost

Google lança Android Bench para avaliar a IA no desenvolvimento mobile

Google disponibilizou o Android Bench, a primeira ferramenta especializada para avaliar as capacidades de grandes modelos de linguagem no desenvolvimento de aplicativos para Android.

7 de mar. de 2026·2 min
OpenAI apresenta Codex Security para detecção e correção automáticas de vulnerabilidades no código
LLMMarkTechPost

OpenAI apresenta Codex Security para detecção e correção automáticas de vulnerabilidades no código

A OpenAI lança o Codex Security, um agente inteligente para análise de segurança de código que não só encontra falhas, mas também propõe patches prontos para corrigi-las.

7 de mar. de 2026·2 min