MarkTechPost
Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.
Últimas publicações

Liquid AI lançou um sistema para executar agentes de AI totalmente no dispositivo
A Liquid AI apresentou o modelo LFM2-24B-A2B e o aplicativo LocalCowork — uma combinação para executar fluxos de trabalho complexos de agentes de AI sem uma única chamada à nuvem. A privacidade passa a ser um princípio a

Yuan 3.0 Ultra: um trilhão de parâmetros com eficiência recorde
A chinesa YuanLab AI apresentou um modelo multimodal aberto com um trilhão de parâmetros, mas que ativa apenas 68,8 bilhões deles. Uma redução de um terço nos parâmetros com aumento de 49% na eficiência de treinamento —

Alibaba lança OpenSandbox, um ambiente unificado para a operação segura de agentes de AI
A Alibaba abriu o código-fonte do OpenSandbox, uma ferramenta que oferece a agentes de AI sandboxes isoladas para execução de código, navegação na web e treinamento de modelos. É uma aposta em um padrão para toda a infra

Alibaba lançou o Qwen 3.5 Small — modelos compactos para rodar diretamente nos dispositivos
A nova série de modelos da Alibaba, de 0,8 a 9 bilhões de parâmetros, desafia a corrida por tamanho. A filosofia de «mais inteligência, menos computação» pode mudar as regras do jogo para o AI móvel.

SHAP-IQ: um novo padrão de AI explicável chega ao uso prático
A biblioteca SHAP-IQ permite não apenas avaliar a importância dos atributos de um modelo, mas também entender como eles interagem entre si. Explicamos por que isso muda a abordagem da interpretação em aprendizado de máqu

Google apresenta STATIC: busca generativa 948 vezes mais rápida
O Google AI desenvolveu um framework baseado em matrizes esparsas que acelera a decodificação em sistemas de recomendação generativos em quase mil vezes. Isso pode mudar a abordagem das recomendações em escala industrial

Alibaba lança CoPaw — uma estação de trabalho para escalar agentes de AI
A equipe da Alibaba lançou o framework open-source CoPaw, que transforma a máquina local do desenvolvedor em um ambiente completo para executar agentes autônomos de AI com memória e fluxos de trabalho multicanal.

Unified Latents: Google DeepMind encontra uma forma de melhorar a geração por AI
O novo framework Unified Latents, da Google DeepMind, resolve o dilema entre a qualidade da compressão de dados e a precisão das redes neurais.

Sakana AI aprendeu a adaptar instantaneamente modelos de linguagem sem fine-tuning
O laboratório de Tóquio Sakana AI apresentou dois métodos — Doc-to-LoRA e Text-to-LoRA — que permitem adaptar grandes modelos de linguagem a novos dados em frações de segundo, sem fine-tuning clássico.

Perplexity lança pplx-embed: modelos de embeddings que mudam as regras da busca
A Perplexity apresentou a família multilíngue de modelos de embeddings pplx-embed, baseada em Qwen3 com atenção bidirecional — e afirma estabelecer um novo padrão de qualidade para busca em escala de internet.

Liquid AI desafia a corrida por modelos maiores: a arquitetura híbrida do LFM2 muda as regras
A startup Liquid AI apresentou um modelo de 24 bilhões de parâmetros que combina o mecanismo de atenção com convoluções. O objetivo é resolver os problemas de escalabilidade enfrentados por toda a indústria de grandes mo

Composio abre o código do Agent Orchestrator, uma ferramenta para sistemas multiagentes além do ReAct
A startup Composio lançou em código aberto um orquestrador de agentes que enfrenta o principal problema da AI em produção: a fragilidade dos ciclos simples de ReAct. A nova abordagem promete fluxos de trabalho multiagent

O modo WebSocket da OpenAI muda as regras do jogo para a AI de voz
A OpenAI apresentou um modo WebSocket para a Realtime API que elimina o principal inimigo dos agentes de AI de voz: a latência. Três etapas separadas do processamento de voz agora são condensadas em um único fluxo.

Taalas desafia as GPUs: lógica fixa em vez de flexibilidade para 17.000 tokens por segundo
A startup canadense Taalas aposta no que a indústria de chips de AI considerava heresia — substituir GPUs programáveis por chips especializados de lógica fixa. O resultado: 17.000 tokens por segundo.

TruLens: como parar de confiar cegamente em LLMs e começar a medir a qualidade
Os modelos de linguagem ainda continuam sendo caixas-pretas para a maioria dos desenvolvedores. O TruLens oferece um conjunto de ferramentas que torna cada etapa do funcionamento de um LLM transparente e mensurável — dos

Google defende pensar mais profundamente, não por mais tempo — e reduz pela metade os custos de inferência
Pesquisadores do Google e da Universidade da Virgínia mostraram que uma cadeia de raciocínio longa não é necessariamente melhor. A nova métrica Deep-Thinking Ratio permite aumentar a precisão das LLMs e cortar os custos

Google DeepMind apresentou Lyria 3 para criar música a partir de fotos
O novo modelo Lyria 3, da Google DeepMind, representa um avanço na geração de áudio. Agora, a AI pode criar faixas completas com vocais e letras usando apenas fotos ou descrições em texto.

Tavus apresenta o Phoenix-4: avatares de vídeo com emoções realistas e resposta instantânea
O novo modelo Phoenix-4 supera o efeito do «vale da estranheza», adicionando inteligência emocional aos avatares digitais e reduzindo a latência de geração a um recorde de 600 milissegundos.

Anthropic apresenta Claude 4.6 Sonnet com uma janela de contexto de 1 milhão de tokens
A Anthropic entra na era dos modelos de raciocínio. Claude 4.6 Sonnet recebeu uma janela de contexto de 1 milhão de tokens e um sistema inovador de verificação de fatos por meio da execução de código.

Google DeepMind apresentou um framework para delegação inteligente de tarefas entre agentes de AI
Pesquisadores desenvolveram um sistema para criar uma “agentic web” segura, na qual programas autônomos poderão interagir de forma eficiente e escalar.

Google apresentou o WebMCP: um novo padrão para a interação de agentes de AI com a web
Google apresentou o protocolo WebMCP, que permitirá que agentes de AI interajam com sites diretamente por meio da estrutura do código, contornando a análise de capturas de tela, lenta e intensiva em recursos.

Arquitetura da memória: como ensinar agentes de AI a lembrar do que importa e raciocinar de forma lógica
Análise de um novo conceito de memória para redes neurais: a transição do simples armazenamento do histórico de diálogos para bases de conhecimento estruturadas para análise profunda de dados.

Guia para criar um pipeline de dados sintéticos com CTGAN e SDV
Saiba como construir um sistema confiável de geração de dados tabulares que garante alta precisão e preserva todos os padrões estatísticos para o treinamento seguro de redes neurais.

Como treinar AI com preferências humanas: guia de DPO e QLoRA
Um novo tutorial mostra como ajustar modelos de linguagem de forma eficiente às preferências humanas sem usar modelos de recompensa pesados, com apenas uma GPU.

Google Gemini 3 Deep Think: novo recorde em testes de inteligência geral
O Google apresentou o Gemini 3 Deep Think. O modelo alcançou 84,6% no teste ARC-AGI-2, aproximando a indústria da criação de AGI por meio de mecanismos de raciocínio lógico profundo.

OpenAI apresentou GPT-5.3-Codex-Spark: uma revolução na velocidade do desenvolvimento de software
A OpenAI lançou um modelo ultrarrápido para programação. Graças aos chips da Cerebras, ele entrega 1.000 tokens por segundo, 15 vezes mais rápido do que as versões padrão.

Como treinar embeddings Matryoshka para busca de dados ultrarrápida
Saiba como a tecnologia Matryoshka Representation Learning permite reduzir o tamanho dos vetores para 64 dimensões sem perda significativa na precisão da busca.

NVIDIA apresentou o KVTC: tecnologia de compressão de cache de LLM acelerará em 20 vezes o funcionamento das redes neurais
Pesquisadores da NVIDIA apresentaram o KVTC, um método inovador de compressão de KV-cache. A tecnologia permite reduzir o consumo de memória em 20 vezes, resolvendo o principal problema de escalabilidade dos modelos de l

Como simplificar o desenvolvimento de redes neurais: guia para usar o Einops em cálculos com tensores
A biblioteca Einops está se tornando o padrão para trabalhar com tensores em deep learning. Explicamos como deixar o código mais limpo e evitar erros em arquiteturas de Vision e Attention.

Google apresentou o NAI: interfaces adaptativas baseadas em Gemini para design inclusivo
O Google Research propõe repensar a acessibilidade de software. O framework NAI usa agentes de AI do Gemini para adaptar instantaneamente a interface às capacidades físicas e ao contexto do usuário.