Simon Willison→ original

Tencent Abriu o Código-Fonte do LLM Hy3 com 295 Bilhões de Parâmetros

Tencent publicou o código-fonte aberto para LLM Hy3 — um modelo de linguagem Mixture-of-Experts (MoE) com 295 bilhões de parâmetros, dos quais 21 bilhões estão ativos durante a inferência. O modelo tem uma janela de contexto de 256K tokens. De acordo com as afirmações da Tencent, Hy3 supera modelos abertos de tamanho similar e compete com LLMs abertos líderes que são 2–5 vezes maiores. A licença Apache 2.0 permite o uso livre do modelo em projetos comerciais. Até 21 de julho, Hy3 está disponível gratuitamente na plataforma OpenRouter.

Processado por IA de Simon Willison; editado por Hamidun News
Tencent Abriu o Código-Fonte do LLM Hy3 com 295 Bilhões de Parâmetros
Fonte: Simon Willison. Colagem: Hamidun News.
◐ Ouvir artigo

Tencent lançou o LLM Hy3 (Hyperbolic Model 3) sob uma licença livre Apache 2.0. É um dos poucos modelos abertos do líder de IA chinês, fornecido à comunidade para desenvolvimento e pesquisa.

Características do Hy3

O modelo é construído em uma arquitetura Mixture-of-Experts (MoE) e compreende 295 bilhões de parâmetros. Porém, durante a inferência, apenas 21 bilhões de parâmetros estão ativos, o que reduz os requisitos computacionais sem sacrificar o desempenho. A camada MTP adiciona 3,8 bilhões de parâmetros para ajuste de saída. O comprimento da janela de contexto é de 256K tokens — suficiente para analisar documentos longos, bases de código ou diálogos.

O tamanho completo do modelo no disco é de 598 gigabytes. A versão quantizada em formato FP8 ocupa 300 gigabytes, tornando-a mais acessível para implantação em hardware padrão.

Desempenho

De acordo com a Tencent, o Hy3 supera modelos abertos de tamanho de parâmetro similar em testes e mostra resultados comparáveis aos modelos flagship que são 2–5 vezes maiores. A empresa coletou feedback de 50+ produtos e fabricantes de aplicativos, refinando o modelo após a versão Preview lançada em abril de 2026.

  • Parâmetros totais: 295 bilhões
  • Parâmetros ativos durante inferência: 21 bilhões
  • Janela de contexto: 256K tokens
  • Tamanho completo do modelo: 598 GB
  • Tamanho quantizado (FP8): 300 GB
  • Licença: Apache 2.0

Disponibilidade e Implantação

O modelo é hospedado no Hugging Face e está disponível para uso gratuito na plataforma OpenRouter até 21 de julho de 2026. Isso permite que os desenvolvedores testem o modelo antes de implantá-lo em suas próprias infraestruturas. Apache 2.0 significa que as empresas podem usar Hy3 em produtos comerciais sem restrições, desde que cumpram com as condições de licença (principalmente — atribuição).

Por que isso importa

O lançamento do Hy3 fortalece a posição de Tencent como um ator significativo no mercado global de LLM. Até agora, a maioria dos modelos abertos e competitivos vieram de laboratórios ocidentais (Meta, Mistral, OpenAI) ou de outras regiões (Alibaba, ByteDance na China). Hy3, com seu contexto de 256K e arquitetura MoE, demonstra que os desenvolvedores chineses alcançaram paridade em escala e capacidades de modelo.

Para a comunidade de desenvolvedores, isso expande a escolha de modelos abertos e permite uma seleção de ferramentas mais flexível para tarefas específicas sem dependência de APIs fechadas.

O que isso significa

O mercado global de LLMs abertos está se tornando mais competitivo, o que reduz os custos de API e infraestrutura e acelera a inovação. Empresas como Tencent investem em modelos abertos como estratégia para ganhar confiança da comunidade e fortalecer sua marca em IA. O acesso gratuito no OpenRouter até meados de julho é um movimento de marketing que permite aquisição rápida de usuários e coleta de feedback.

ZK
Hamidun News
Notícias de AI sem ruído. Seleção editorial diária de mais de 50 fontes. Produto de Zhemal Khamidun, Head of AI na Alpina Digital.

Quer parar de ler sobre IA e começar a usar?

AI News é um feed curado de notícias de IA. A Hamidun Academy ensina você a usar IA no trabalho.

O que você acha?
Carregando comentários…