Editora · verificada pela redação

MarkTechPost

Fonte de notícias de IA. Os artigos são selecionados e adaptados pela redação do Hamidun News.

292 artigos no Hamidun·Último: 3 de agosto· Ativo·marktechpost.com ↗

Últimas publicações

Liquid AI lançou um sistema para executar agentes de AI totalmente no dispositivo
LLMMarkTechPost

Liquid AI lançou um sistema para executar agentes de AI totalmente no dispositivo

A Liquid AI apresentou o modelo LFM2-24B-A2B e o aplicativo LocalCowork — uma combinação para executar fluxos de trabalho complexos de agentes de AI sem uma única chamada à nuvem. A privacidade passa a ser um princípio a

6 de mar. de 2026·3 min
Yuan 3.0 Ultra: um trilhão de parâmetros com eficiência recorde
LLMMarkTechPost

Yuan 3.0 Ultra: um trilhão de parâmetros com eficiência recorde

A chinesa YuanLab AI apresentou um modelo multimodal aberto com um trilhão de parâmetros, mas que ativa apenas 68,8 bilhões deles. Uma redução de um terço nos parâmetros com aumento de 49% na eficiência de treinamento —

5 de mar. de 2026·3 min
Alibaba lança OpenSandbox, um ambiente unificado para a operação segura de agentes de AI
LLMMarkTechPost

Alibaba lança OpenSandbox, um ambiente unificado para a operação segura de agentes de AI

A Alibaba abriu o código-fonte do OpenSandbox, uma ferramenta que oferece a agentes de AI sandboxes isoladas para execução de código, navegação na web e treinamento de modelos. É uma aposta em um padrão para toda a infra

3 de mar. de 2026·3 min
Alibaba lançou o Qwen 3.5 Small — modelos compactos para rodar diretamente nos dispositivos
LLMMarkTechPost

Alibaba lançou o Qwen 3.5 Small — modelos compactos para rodar diretamente nos dispositivos

A nova série de modelos da Alibaba, de 0,8 a 9 bilhões de parâmetros, desafia a corrida por tamanho. A filosofia de «mais inteligência, menos computação» pode mudar as regras do jogo para o AI móvel.

3 de mar. de 2026·3 min
SHAP-IQ: um novo padrão de AI explicável chega ao uso prático
LLMMarkTechPost

SHAP-IQ: um novo padrão de AI explicável chega ao uso prático

A biblioteca SHAP-IQ permite não apenas avaliar a importância dos atributos de um modelo, mas também entender como eles interagem entre si. Explicamos por que isso muda a abordagem da interpretação em aprendizado de máqu

2 de mar. de 2026·3 min
Google apresenta STATIC: busca generativa 948 vezes mais rápida
LLMMarkTechPost

Google apresenta STATIC: busca generativa 948 vezes mais rápida

O Google AI desenvolveu um framework baseado em matrizes esparsas que acelera a decodificação em sistemas de recomendação generativos em quase mil vezes. Isso pode mudar a abordagem das recomendações em escala industrial

2 de mar. de 2026·3 min
Alibaba lança CoPaw — uma estação de trabalho para escalar agentes de AI
LLMMarkTechPost

Alibaba lança CoPaw — uma estação de trabalho para escalar agentes de AI

A equipe da Alibaba lançou o framework open-source CoPaw, que transforma a máquina local do desenvolvedor em um ambiente completo para executar agentes autônomos de AI com memória e fluxos de trabalho multicanal.

1 de mar. de 2026·2 min
Unified Latents: Google DeepMind encontra uma forma de melhorar a geração por AI
LLMMarkTechPost

Unified Latents: Google DeepMind encontra uma forma de melhorar a geração por AI

O novo framework Unified Latents, da Google DeepMind, resolve o dilema entre a qualidade da compressão de dados e a precisão das redes neurais.

28 de fev. de 2026·2 min
Sakana AI aprendeu a adaptar instantaneamente modelos de linguagem sem fine-tuning
LLMMarkTechPost

Sakana AI aprendeu a adaptar instantaneamente modelos de linguagem sem fine-tuning

O laboratório de Tóquio Sakana AI apresentou dois métodos — Doc-to-LoRA e Text-to-LoRA — que permitem adaptar grandes modelos de linguagem a novos dados em frações de segundo, sem fine-tuning clássico.

27 de fev. de 2026·3 min
Perplexity lança pplx-embed: modelos de embeddings que mudam as regras da busca
LLMMarkTechPost

Perplexity lança pplx-embed: modelos de embeddings que mudam as regras da busca

A Perplexity apresentou a família multilíngue de modelos de embeddings pplx-embed, baseada em Qwen3 com atenção bidirecional — e afirma estabelecer um novo padrão de qualidade para busca em escala de internet.

27 de fev. de 2026·3 min
Liquid AI desafia a corrida por modelos maiores: a arquitetura híbrida do LFM2 muda as regras
LLMMarkTechPost

Liquid AI desafia a corrida por modelos maiores: a arquitetura híbrida do LFM2 muda as regras

A startup Liquid AI apresentou um modelo de 24 bilhões de parâmetros que combina o mecanismo de atenção com convoluções. O objetivo é resolver os problemas de escalabilidade enfrentados por toda a indústria de grandes mo

25 de fev. de 2026·3 min
Composio abre o código do Agent Orchestrator, uma ferramenta para sistemas multiagentes além do ReAct
LLMMarkTechPost

Composio abre o código do Agent Orchestrator, uma ferramenta para sistemas multiagentes além do ReAct

A startup Composio lançou em código aberto um orquestrador de agentes que enfrenta o principal problema da AI em produção: a fragilidade dos ciclos simples de ReAct. A nova abordagem promete fluxos de trabalho multiagent

24 de fev. de 2026·3 min
O modo WebSocket da OpenAI muda as regras do jogo para a AI de voz
LLMMarkTechPost

O modo WebSocket da OpenAI muda as regras do jogo para a AI de voz

A OpenAI apresentou um modo WebSocket para a Realtime API que elimina o principal inimigo dos agentes de AI de voz: a latência. Três etapas separadas do processamento de voz agora são condensadas em um único fluxo.

24 de fev. de 2026·3 min
Taalas desafia as GPUs: lógica fixa em vez de flexibilidade para 17.000 tokens por segundo
LLMMarkTechPost

Taalas desafia as GPUs: lógica fixa em vez de flexibilidade para 17.000 tokens por segundo

A startup canadense Taalas aposta no que a indústria de chips de AI considerava heresia — substituir GPUs programáveis por chips especializados de lógica fixa. O resultado: 17.000 tokens por segundo.

23 de fev. de 2026·3 min
TruLens: como parar de confiar cegamente em LLMs e começar a medir a qualidade
LLMMarkTechPost

TruLens: como parar de confiar cegamente em LLMs e começar a medir a qualidade

Os modelos de linguagem ainda continuam sendo caixas-pretas para a maioria dos desenvolvedores. O TruLens oferece um conjunto de ferramentas que torna cada etapa do funcionamento de um LLM transparente e mensurável — dos

23 de fev. de 2026·3 min
Google defende pensar mais profundamente, não por mais tempo — e reduz pela metade os custos de inferência
LLMMarkTechPost

Google defende pensar mais profundamente, não por mais tempo — e reduz pela metade os custos de inferência

Pesquisadores do Google e da Universidade da Virgínia mostraram que uma cadeia de raciocínio longa não é necessariamente melhor. A nova métrica Deep-Thinking Ratio permite aumentar a precisão das LLMs e cortar os custos

22 de fev. de 2026·3 min
Google DeepMind apresentou Lyria 3 para criar música a partir de fotos
LLMMarkTechPost

Google DeepMind apresentou Lyria 3 para criar música a partir de fotos

O novo modelo Lyria 3, da Google DeepMind, representa um avanço na geração de áudio. Agora, a AI pode criar faixas completas com vocais e letras usando apenas fotos ou descrições em texto.

19 de fev. de 2026·2 min
Tavus apresenta o Phoenix-4: avatares de vídeo com emoções realistas e resposta instantânea
LLMMarkTechPost

Tavus apresenta o Phoenix-4: avatares de vídeo com emoções realistas e resposta instantânea

O novo modelo Phoenix-4 supera o efeito do «vale da estranheza», adicionando inteligência emocional aos avatares digitais e reduzindo a latência de geração a um recorde de 600 milissegundos.

19 de fev. de 2026·2 min
Anthropic apresenta Claude 4.6 Sonnet com uma janela de contexto de 1 milhão de tokens
LLMMarkTechPost

Anthropic apresenta Claude 4.6 Sonnet com uma janela de contexto de 1 milhão de tokens

A Anthropic entra na era dos modelos de raciocínio. Claude 4.6 Sonnet recebeu uma janela de contexto de 1 milhão de tokens e um sistema inovador de verificação de fatos por meio da execução de código.

18 de fev. de 2026·2 min
Google DeepMind apresentou um framework para delegação inteligente de tarefas entre agentes de AI
LLMMarkTechPost

Google DeepMind apresentou um framework para delegação inteligente de tarefas entre agentes de AI

Pesquisadores desenvolveram um sistema para criar uma “agentic web” segura, na qual programas autônomos poderão interagir de forma eficiente e escalar.

16 de fev. de 2026·2 min
Google apresentou o WebMCP: um novo padrão para a interação de agentes de AI com a web
LLMMarkTechPost

Google apresentou o WebMCP: um novo padrão para a interação de agentes de AI com a web

Google apresentou o protocolo WebMCP, que permitirá que agentes de AI interajam com sites diretamente por meio da estrutura do código, contornando a análise de capturas de tela, lenta e intensiva em recursos.

15 de fev. de 2026·2 min
Arquitetura da memória: como ensinar agentes de AI a lembrar do que importa e raciocinar de forma lógica
LLMMarkTechPost

Arquitetura da memória: como ensinar agentes de AI a lembrar do que importa e raciocinar de forma lógica

Análise de um novo conceito de memória para redes neurais: a transição do simples armazenamento do histórico de diálogos para bases de conhecimento estruturadas para análise profunda de dados.

15 de fev. de 2026·2 min
Guia para criar um pipeline de dados sintéticos com CTGAN e SDV
LLMMarkTechPost

Guia para criar um pipeline de dados sintéticos com CTGAN e SDV

Saiba como construir um sistema confiável de geração de dados tabulares que garante alta precisão e preserva todos os padrões estatísticos para o treinamento seguro de redes neurais.

14 de fev. de 2026·3 min
Como treinar AI com preferências humanas: guia de DPO e QLoRA
LLMMarkTechPost

Como treinar AI com preferências humanas: guia de DPO e QLoRA

Um novo tutorial mostra como ajustar modelos de linguagem de forma eficiente às preferências humanas sem usar modelos de recompensa pesados, com apenas uma GPU.

13 de fev. de 2026·2 min
Google Gemini 3 Deep Think: novo recorde em testes de inteligência geral
LLMMarkTechPost

Google Gemini 3 Deep Think: novo recorde em testes de inteligência geral

O Google apresentou o Gemini 3 Deep Think. O modelo alcançou 84,6% no teste ARC-AGI-2, aproximando a indústria da criação de AGI por meio de mecanismos de raciocínio lógico profundo.

13 de fev. de 2026·2 min
OpenAI apresentou GPT-5.3-Codex-Spark: uma revolução na velocidade do desenvolvimento de software
LLMMarkTechPost

OpenAI apresentou GPT-5.3-Codex-Spark: uma revolução na velocidade do desenvolvimento de software

A OpenAI lançou um modelo ultrarrápido para programação. Graças aos chips da Cerebras, ele entrega 1.000 tokens por segundo, 15 vezes mais rápido do que as versões padrão.

13 de fev. de 2026·2 min
Como treinar embeddings Matryoshka para busca de dados ultrarrápida
LLMMarkTechPost

Como treinar embeddings Matryoshka para busca de dados ultrarrápida

Saiba como a tecnologia Matryoshka Representation Learning permite reduzir o tamanho dos vetores para 64 dimensões sem perda significativa na precisão da busca.

12 de fev. de 2026·2 min
NVIDIA apresentou o KVTC: tecnologia de compressão de cache de LLM acelerará em 20 vezes o funcionamento das redes neurais
LLMMarkTechPost

NVIDIA apresentou o KVTC: tecnologia de compressão de cache de LLM acelerará em 20 vezes o funcionamento das redes neurais

Pesquisadores da NVIDIA apresentaram o KVTC, um método inovador de compressão de KV-cache. A tecnologia permite reduzir o consumo de memória em 20 vezes, resolvendo o principal problema de escalabilidade dos modelos de l

11 de fev. de 2026·2 min
Como simplificar o desenvolvimento de redes neurais: guia para usar o Einops em cálculos com tensores
LLMMarkTechPost

Como simplificar o desenvolvimento de redes neurais: guia para usar o Einops em cálculos com tensores

A biblioteca Einops está se tornando o padrão para trabalhar com tensores em deep learning. Explicamos como deixar o código mais limpo e evitar erros em arquiteturas de Vision e Attention.

11 de fev. de 2026·2 min
Google apresentou o NAI: interfaces adaptativas baseadas em Gemini para design inclusivo
LLMMarkTechPost

Google apresentou o NAI: interfaces adaptativas baseadas em Gemini para design inclusivo

O Google Research propõe repensar a acessibilidade de software. O framework NAI usa agentes de AI do Gemini para adaptar instantaneamente a interface às capacidades físicas e ao contexto do usuário.

11 de fev. de 2026·2 min