MarkTechPost
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

SmolAgents: Como Construir um Sistema de IA Multi-Agente com Código e Orquestração Dinâmica
Uma análise da implementação do SmolAgents mostra como agentes de IA leves executam código, invocam ferramentas, trabalham com memória e coordenam tarefas dentro de um único sistema.

NetKet e JAX: como construir um modelo Transformer para sistemas de spins frustrados
O guia mostra como construir um pipeline de VMC de pesquisa usando NetKet, JAX e arquitetura Transformer para modelar uma cadeia de spin frustrada J1-J2.

OpenAI apresentou GPT-Rosalind — um modelo de IA para biologia, genômica e desenvolvimento de medicamentos
OpenAI lançou GPT-Rosalind — um modelo especializado para biologia e farmacêutica que ajuda a acelerar o desenvolvimento de medicamentos, análise de dados genômicos e planejamento de experimentos.

Google apresentou Auto-Diagnose — sistema de IA para encontrar causas de falhas em testes de integração
Google apresentou Auto-Diagnose — um sistema baseado em Gemini 2.5 Flash que analisa automaticamente logs de testes de integração com falha e identifica a causa raiz da falha com 90,14% de precisão.

OpenAI GPT-OSS: Lançando Modelos Open-Weight no Colab com MXFP4 e Inferência Avançada
Um novo guia explica como lançar openai/gpt-oss-20b no Google Colab: instalar dependências para Transformers, verificar GPU, ativar quantização MXFP4 e construir um pipeline de inferência funcional.

Anthropic lança Claude Opus 4.7 para programação de agentes, visão e tarefas autônomas
Anthropic apresentou Claude Opus 4.7 — uma atualização do modelo de referência com melhorias notáveis em codificação de agentes, análise de imagens detalhadas e tarefas autônomas longas.

PrismML Bonsai: Como executar um modelo 1-bit em CUDA com GGUF, JSON e RAG
Em um novo tutorial de PrismML Bonsai, cobrimos como executar Bonsai-1.7B em GPU via CUDA e GGUF, medir throughput, configurar chat, saída JSON rigorosa e um cenário RAG básico.

xAI lança APIs Grok separadas para reconhecimento e síntese de fala para desenvolvedores corporativos
xAI separou a pilha de voz do Grok em APIs autônomas: Speech-to-Text e Text-to-Speech para negócios com preços agressivos, suporte multilíngue e foco no mercado de aplicações de voz.

NVIDIA lançou Ising — a primeira família aberta de modelos de IA para sistemas quântico-clássicos
NVIDIA apresentou Ising — uma família aberta de modelos de IA para calibração de processadores quânticos e correção de erros, para trazer sistemas híbridos quântico-clássicos úteis mais próximos à realidade.

Por que LoRA quebra em produção e como RS-LoRA salva o ajuste fino de modelos
LoRA funciona bem com estilo e formato, mas perde sinal ao ajustar com novos fatos; RS-LoRA resolve o problema mudando a fórmula de escalonamento para uma mais estável.

OpenKB e OpenRouter mostram como construir uma base de conhecimento IA local com busca em Llama
Um novo tutorial explica como implantar uma base de conhecimento local no OpenKB, conectar um modelo aberto via OpenRouter e configurar a busca com segurança sem codificar chaves.

OpenAI e Magika mostraram como construir um pipeline para reconhecimento de arquivos e análise de ameaças
O guia demonstra um pipeline prático onde Magika determina o tipo real do arquivo a partir de bytes, e OpenAI ajuda a interpretar o resultado e identificar riscos potenciais.

Meta apresentou Sapiens2 — um modelo unificado de visão computacional para pose, segmentação e 3D
Meta Reality Labs lançou Sapiens2 — uma família de modelos de visão para análise humana que resolve pose, segmentação, geometria de superfície e mapeamento 3D a partir de uma única arquitetura.

OpenMOSS lança MOSS-Audio — modelo de áudio aberto que supera alternativas maiores
OpenMOSS apresentou MOSS-Audio — um modelo aberto que compreende fala, música e sons ambientes em uma única arquitetura e supera modelos open-source significativamente maiores em benchmarks de áudio comuns.

Embeddings OpenAI e RL: Como Construir um Agente com Memória de Longo Prazo para Respostas Precisas
O tutorial mostra como treinar um agente RL para selecionar registros relevantes da memória de longo prazo, de forma que uma LLM responda com mais precisão perguntas sobre fatos armazenados.

Como Medir a Inteligência Real: Principais Benchmarks para Agentes de IA
Testes clássicos não refletem mais as capacidades reais das redes neurais. Exploramos quais benchmarks realmente mostram se um agente de IA está pronto para aplicações comerciais no mundo real.

Memória Elástica para IA: Como kvcached Resolve a Escassez de GPU
A distribuição dinâmica de cache KV promete reduzir drasticamente o custo de hospedagem de modelos de linguagem, permitindo o compartilhamento eficiente de memória de uma única GPU.

Modelo de Voz da xAI Supera GPT Realtime em Tarefas Empresariais
A empresa de Elon Musk, xAI, apresentou o grok-voice-think-fast-1.0. O novo modelo superou soluções da OpenAI e Google no gerenciamento de fluxos de trabalho empresariais complexos.

GitNexus: Como uma nova ferramenta ensinou agentes IA a compreender estruturalmente o código
Assistentes de IA são excelentes em escrever código local, mas frequentemente não conseguem entender a arquitetura global de projetos. O projeto open-source GitNexus resolve este problema usando grafos de conhecimento e

DeepSeek-V4: Como novos algoritmos de compressão tornaram o contexto de um milhão de tokens uma realidade
A DeepSeek apresentou a quarta geração de seus modelos. Através da compressão radical de atenção, o processamento de enormes volumes de dados está se tornando acessível não apenas para gigantes da tecnologia.

Arquitetura Decoupled DiLoCo do DeepMind Resolve Problema de Escalabilidade da IA
O treinamento de modelos avançados de IA sempre foi refém de falhas de hardware: a quebra de um chip paralisava todo o cluster. Uma nova arquitetura do Google DeepMind muda as regras do jogo.

OpenMythos: reconstrução open-source da arquitetura Claude Mythos em PyTorch com 770M parâmetros
O desenvolvedor Kye Gomez reconstruiu a presumida arquitetura Claude Mythos da Anthropic do zero — sem vazamentos, apenas com base em pesquisa pública.

OpenAI Expande GPT-5.4-Cyber para Profissionais Verificados de Segurança Cibernética
OpenAI abre acesso amplo ao GPT-5.4-Cyber — uma versão refinada do GPT-5.4 sem restrições padrão para milhares de defensores verificados.

Moonshot AI lança Kimi K2.6: modelo agêntico com um enxame de 300 subagentes
O laboratório chinês Moonshot AI abriu o código-fonte do Kimi K2.6, um modelo agêntico multimodal que coordena autonomamente até 300 subagentes e 4.000 etapas.

Phi-4-Mini da Microsoft: implementação de quantização, RAG e LoRA em um único notebook Jupyter
O tutorial mostra o pipeline completo com o Phi-4-mini-instruct: quantização de 4 bits, geração em streaming, raciocínio, chamada de ferramentas, RAG e LoRA fine-tuning em um único notebook.

Qwen 3.6-35B-A3B na prática: multimodalidade, MoE e RAG em um único pipeline
Uma análise detalhada da implementação do Qwen 3.6-35B-A3B, do carregamento do modelo a RAG, tool calling e persistência de sessões em fluxos de trabalho reais.

NVIDIA apresentou o Nemotron 3 Super — um modelo aberto com 120 bilhões de parâmetros
O novo modelo híbrido combina as arquiteturas Mamba e Attention com a abordagem Mixture-of-Experts, garantindo um ganho de desempenho de 5x para sistemas multiagentes. A distância entre modelos proprietários e abertos es

Google apresentou TensorFlow 2.21 e LiteRT para AI móvel
Google apresentou TensorFlow 2.21 e LiteRT, um novo padrão para executar redes neurais em smartphones com suporte a NPU e aceleração por GPU para plataformas móveis.

Google lança Android Bench para avaliar a IA no desenvolvimento mobile
Google disponibilizou o Android Bench, a primeira ferramenta especializada para avaliar as capacidades de grandes modelos de linguagem no desenvolvimento de aplicativos para Android.

OpenAI apresenta Codex Security para detecção e correção automáticas de vulnerabilidades no código
A OpenAI lança o Codex Security, um agente inteligente para análise de segurança de código que não só encontra falhas, mas também propõe patches prontos para corrigi-las.