Latent Space→ original

Thinky выпустила открытую модель Inkling 975B-A41B по лицензии Apache 2.0

Thinky представила Inkling — мультимодальную MoE-модель на 975 млрд параметров (41 млрд активных) с открытыми весами под Apache 2.0. Это первый полноценный релиз большой языковой модели у компании. Вместе с флагманом вышла компактная Inkling-Small на 276 млрд параметров. Модель заявлена как лучшая американская открытая модель под лицензией Apache 2.0.

Processado por IA de Latent Space; editado por Hamidun News
Thinky выпустила открытую модель Inkling 975B-A41B по лицензии Apache 2.0
Fonte: Latent Space. Colagem: Hamidun News.
◐ Ouvir artigo

A Thinky lançou o Inkling em julho de 2026 — um modelo de linguagem multimodal com 975 bilhões de parâmetros e pesos abertos sob a licença Apache 2.0. É o primeiro lançamento completo de um modelo de linguagem grande da empresa, e ele já saiu com pesos abertos.

Que modelo é o Inkling

O Inkling é construído sobre a arquitetura Mixture-of-Experts: dos 975 bilhões de parâmetros, apenas 41 bilhões ficam ativos a cada solicitação (daí a designação 975B-A41B). Um modelo MoE roteia cada token para um subconjunto de "especialistas", então o tamanho acaba sendo de nível principal, enquanto o custo de inferência se assemelha ao de um modelo denso muito menor. Para o usuário, isso significa que o Inkling responde como um sistema de 975 bilhões de parâmetros, mas em velocidade e custo por solicitação fica mais próximo de um modelo de 41 bilhões — é justamente por esse equilíbrio que os maiores laboratórios usam o MoE. O Inkling é multimodal — não trabalha só com texto.

Junto com o modelo principal, a Thinky também lançou uma versão mais leve — o Inkling-Small, com 276 bilhões de parâmetros e 12 bilhões ativos (276B-A12B). Os dois modelos usam a mesma abordagem MoE e se diferenciam pelo tamanho; o menor é voltado para quem não tem o hardware necessário para o maior.

  • Modelo principal: Inkling, 975B no total / 41B ativos (975B-A41B), multimodal
  • Versão compacta: Inkling-Small, 276B / 12B ativos (276B-A12B)
  • Licença: Apache 2.0 — pesos abertos, uso comercial sem restrições
  • Posicionamento: apresentado como o melhor modelo aberto americano sob a Apache 2.0
  • Desenvolvedor: Thinky, para quem este é o primeiro lançamento completo de um LLM

Por que os pesos abertos importam

Pesos abertos significam que qualquer pessoa pode baixar o modelo, executá-lo em seu próprio hardware, fazer fine-tuning e integrá-lo a produtos sem precisar recorrer à API de um fornecedor. A licença Apache 2.0 é uma das mais permissivas: permite uso comercial, modificação e distribuição praticamente sem restrições, ao contrário das licenças "community" mais rígidas usadas por parte dos concorrentes. Para startups e corporações, isso elimina as questões jurídicas que impedem que alguns modelos abertos sejam levados para produção.

Segundo a newsletter AI News, da Latent Space, o lançamento saiu forte.

"O primeiro lançamento completo de LLM da

Thinky é uma bomba, e ainda vem com pesos abertos de bônus", diz a newsletter AI News da Latent Space.

Lugar entre os modelos abertos

O Inkling se posiciona como o melhor modelo aberto americano sob a licença Apache 2.0 — é assim que a fonte o descreve. Nos últimos dois anos, quem definiu o padrão em pesos abertos foram principalmente laboratórios chineses: DeepSeek, Qwen, Kimi. Um modelo americano forte, com 975 bilhões de parâmetros e uma licença Apache totalmente aberta, representa uma mudança notável nesse cenário.

O ponto-chave aqui não é só o fato de os pesos serem abertos, mas a licença em si. Muitos modelos abertos populares são lançados sob licenças "community" próprias, com restrições quanto ao número de usuários ou aos cenários de uso. A Apache 2.0 não traz esse tipo de ressalva, por isso um modelo americano lançado justamente sob essa licença reduz parte do risco jurídico para as empresas.

A dupla formada pelo modelo maior e pelo menor (975B-A41B e 276B-A12B) cobre cenários diferentes: o principal para a máxima qualidade, o Inkling-Small para rodar em hardware mais modesto.

O que isso significa

Um modelo multimodal aberto desse tamanho, vindo de uma equipe americana, dá aos desenvolvedores mais uma opção forte, que pode ser implantada localmente e usada comercialmente sem ressalvas de licenciamento. Ter dois tamanhos disponíveis de uma vez permite escolher o modelo conforme o orçamento de computação, e, para o mercado de pesos abertos, isso significa aumento da concorrência para além dos laboratórios chineses.

Perguntas frequentes

O que é o Inkling 975B-A41B?

É o modelo multimodal principal da Thinky, baseado na arquitetura Mixture-of-Experts: 975 bilhões de parâmetros no total e 41 bilhões ativos por solicitação. Os pesos são abertos sob a licença Apache 2.0.

O Inkling é gratuito?

Sim, os pesos são disponibilizados abertamente sob a Apache 2.0 — o modelo pode ser baixado, executado e usado em produtos comerciais de graça. Só é preciso pagar pelo próprio hardware de computação ou pela nuvem.

Qual a diferença entre o Inkling-Small e o modelo principal?

O Inkling-Small é menor: 276 bilhões de parâmetros contra 975 bilhões, e 12 bilhões ativos contra 41 bilhões. Ele é pensado para rodar em hardware menos potente, enquanto o modelo principal visa a máxima qualidade.

⧉ História
ZK
Hamidun News
Notícias de AI sem ruído. Seleção editorial diária de mais de 50 fontes. Produto de Zhemal Khamidun, Head of AI na Alpina Digital.

Precisa de IA funcionando dentro da sua empresa — não só no feed de notícias?

Eu construo IA em produção para empresas — CRM sob medida, ferramentas internas, agentes autônomos, automação de processos. Pertence a você, moldada ao seu processo, sem taxa por usuário. Feito por Zhemal Khamidun, CPO da AlpinaGPT (plataforma de IA, 6.000+ usuários).

O que você acha?
Carregando comentários…