Thinky выпустила открытую модель Inkling 975B-A41B по лицензии Apache 2.0
Thinky представила Inkling — мультимодальную MoE-модель на 975 млрд параметров (41 млрд активных) с открытыми весами под Apache 2.0. Это первый полноценный релиз большой языковой модели у компании. Вместе с флагманом вышла компактная Inkling-Small на 276 млрд параметров. Модель заявлена как лучшая американская открытая модель под лицензией Apache 2.0.
Processado por IA de Latent Space; editado por Hamidun News
A Thinky lançou o Inkling em julho de 2026 — um modelo de linguagem multimodal com 975 bilhões de parâmetros e pesos abertos sob a licença Apache 2.0. É o primeiro lançamento completo de um modelo de linguagem grande da empresa, e ele já saiu com pesos abertos.
Que modelo é o Inkling
O Inkling é construído sobre a arquitetura Mixture-of-Experts: dos 975 bilhões de parâmetros, apenas 41 bilhões ficam ativos a cada solicitação (daí a designação 975B-A41B). Um modelo MoE roteia cada token para um subconjunto de "especialistas", então o tamanho acaba sendo de nível principal, enquanto o custo de inferência se assemelha ao de um modelo denso muito menor. Para o usuário, isso significa que o Inkling responde como um sistema de 975 bilhões de parâmetros, mas em velocidade e custo por solicitação fica mais próximo de um modelo de 41 bilhões — é justamente por esse equilíbrio que os maiores laboratórios usam o MoE. O Inkling é multimodal — não trabalha só com texto.
Junto com o modelo principal, a Thinky também lançou uma versão mais leve — o Inkling-Small, com 276 bilhões de parâmetros e 12 bilhões ativos (276B-A12B). Os dois modelos usam a mesma abordagem MoE e se diferenciam pelo tamanho; o menor é voltado para quem não tem o hardware necessário para o maior.
- Modelo principal: Inkling, 975B no total / 41B ativos (975B-A41B), multimodal
- Versão compacta: Inkling-Small, 276B / 12B ativos (276B-A12B)
- Licença: Apache 2.0 — pesos abertos, uso comercial sem restrições
- Posicionamento: apresentado como o melhor modelo aberto americano sob a Apache 2.0
- Desenvolvedor: Thinky, para quem este é o primeiro lançamento completo de um LLM
Por que os pesos abertos importam
Pesos abertos significam que qualquer pessoa pode baixar o modelo, executá-lo em seu próprio hardware, fazer fine-tuning e integrá-lo a produtos sem precisar recorrer à API de um fornecedor. A licença Apache 2.0 é uma das mais permissivas: permite uso comercial, modificação e distribuição praticamente sem restrições, ao contrário das licenças "community" mais rígidas usadas por parte dos concorrentes. Para startups e corporações, isso elimina as questões jurídicas que impedem que alguns modelos abertos sejam levados para produção.
Segundo a newsletter AI News, da Latent Space, o lançamento saiu forte.
"O primeiro lançamento completo de LLM da
Thinky é uma bomba, e ainda vem com pesos abertos de bônus", diz a newsletter AI News da Latent Space.
Lugar entre os modelos abertos
O Inkling se posiciona como o melhor modelo aberto americano sob a licença Apache 2.0 — é assim que a fonte o descreve. Nos últimos dois anos, quem definiu o padrão em pesos abertos foram principalmente laboratórios chineses: DeepSeek, Qwen, Kimi. Um modelo americano forte, com 975 bilhões de parâmetros e uma licença Apache totalmente aberta, representa uma mudança notável nesse cenário.
O ponto-chave aqui não é só o fato de os pesos serem abertos, mas a licença em si. Muitos modelos abertos populares são lançados sob licenças "community" próprias, com restrições quanto ao número de usuários ou aos cenários de uso. A Apache 2.0 não traz esse tipo de ressalva, por isso um modelo americano lançado justamente sob essa licença reduz parte do risco jurídico para as empresas.
A dupla formada pelo modelo maior e pelo menor (975B-A41B e 276B-A12B) cobre cenários diferentes: o principal para a máxima qualidade, o Inkling-Small para rodar em hardware mais modesto.
O que isso significa
Um modelo multimodal aberto desse tamanho, vindo de uma equipe americana, dá aos desenvolvedores mais uma opção forte, que pode ser implantada localmente e usada comercialmente sem ressalvas de licenciamento. Ter dois tamanhos disponíveis de uma vez permite escolher o modelo conforme o orçamento de computação, e, para o mercado de pesos abertos, isso significa aumento da concorrência para além dos laboratórios chineses.
Perguntas frequentes
O que é o Inkling 975B-A41B?
É o modelo multimodal principal da Thinky, baseado na arquitetura Mixture-of-Experts: 975 bilhões de parâmetros no total e 41 bilhões ativos por solicitação. Os pesos são abertos sob a licença Apache 2.0.
O Inkling é gratuito?
Sim, os pesos são disponibilizados abertamente sob a Apache 2.0 — o modelo pode ser baixado, executado e usado em produtos comerciais de graça. Só é preciso pagar pelo próprio hardware de computação ou pela nuvem.
Qual a diferença entre o Inkling-Small e o modelo principal?
O Inkling-Small é menor: 276 bilhões de parâmetros contra 975 bilhões, e 12 bilhões ativos contra 41 bilhões. Ele é pensado para rodar em hardware menos potente, enquanto o modelo principal visa a máxima qualidade.
Precisa de IA funcionando dentro da sua empresa — não só no feed de notícias?
Eu construo IA em produção para empresas — CRM sob medida, ferramentas internas, agentes autônomos, automação de processos. Pertence a você, moldada ao seu processo, sem taxa por usuário. Feito por Zhemal Khamidun, CPO da AlpinaGPT (plataforma de IA, 6.000+ usuários).
O essencial da IA — uma vez por semana
Sete histórias que realmente importaram, escolhidas a dedo. Sem ruído nem releases.
Pronto! Verifique seu e-mail para a confirmação.