Thinky выпустила открытую модель Inkling 975B-A41B по лицензии Apache 2.0
Thinky представила Inkling — мультимодальную MoE-модель на 975 млрд параметров (41 млрд активных) с открытыми весами под Apache 2.0. Это первый полноценный релиз большой языковой модели у компании. Вместе с флагманом вышла компактная Inkling-Small на 276 млрд параметров. Модель заявлена как лучшая американская открытая модель под лицензией Apache 2.0.
Traité par IA depuis Latent Space ; édité par Hamidun News
Thinky a lancé Inkling en juillet 2026 — un modèle de langage multimodal de 975 milliards de paramètres, aux poids ouverts sous licence Apache 2.0. Il s'agit de la première sortie à part entière d'un grand modèle de langage pour l'entreprise, et elle s'est faite d'emblée avec des poids ouverts.
Quel genre de modèle est Inkling
Inkling repose sur une architecture Mixture-of-Experts : sur les 975 milliards de paramètres, seuls 41 milliards sont actifs à chaque requête (d'où la désignation 975B-A41B). Un modèle MoE route chaque token vers un sous-ensemble d'« experts », si bien que la taille est celle d'un modèle phare, tandis que le coût d'inférence se rapproche de celui d'un modèle dense bien plus petit. Pour l'utilisateur, cela signifie qu'Inkling répond comme un système de 975 milliards de paramètres, mais qu'en vitesse et en coût par requête, il se rapproche d'un modèle de 41 milliards — c'est précisément cet équilibre que recherchent les plus grands laboratoires avec le MoE. Inkling est multimodal : il ne traite pas que du texte.
Avec le modèle phare, Thinky a également publié une version allégée — Inkling-Small, 276 milliards de paramètres dont 12 milliards actifs (276B-A12B). Les deux modèles reposent sur la même approche MoE et diffèrent par leur taille ; le plus petit vise ceux qui ne disposent pas du matériel nécessaire pour le plus grand.
- Modèle phare : Inkling, 975B au total / 41B actifs (975B-A41B), multimodal
- Version compacte : Inkling-Small, 276B / 12B actifs (276B-A12B)
- Licence : Apache 2.0 — poids ouverts, usage commercial sans restriction
- Positionnement : présenté comme le meilleur modèle ouvert américain sous licence Apache 2.0
- Développeur : Thinky, pour qui il s'agit de sa première sortie complète de LLM
Pourquoi les poids ouverts comptent
Des poids ouverts signifient que n'importe qui peut télécharger le modèle, l'exécuter sur son propre matériel, l'affiner et l'intégrer dans des produits sans passer par l'API d'un fournisseur. La licence Apache 2.0 est l'une des plus permissives : elle autorise l'usage commercial, la modification et la distribution quasiment sans restriction, contrairement aux licences « community » plus strictes utilisées par certains concurrents. Pour les startups comme pour les grandes entreprises, cela lève les questions juridiques qui empêchent certains modèles ouverts d'être mis en production.
Selon la newsletter AI News de Latent Space, cette sortie s'est révélée solide.
«
La première sortie complète de LLM de Thinky est une bombe, et elle arrive en prime avec des poids ouverts », indique la newsletter AI News de Latent Space.
Sa place parmi les modèles ouverts
Inkling revendique le titre de meilleur modèle ouvert américain sous licence Apache 2.0 — c'est ainsi que la source le décrit. Ces deux dernières années, la barre en matière de poids ouverts a surtout été fixée par des laboratoires chinois : DeepSeek, Qwen, Kimi. Un modèle américain solide de 975 milliards de paramètres, sous licence Apache entièrement ouverte, marque un tournant notable dans ce paysage.
Ce qui compte ici, ce n'est pas seulement le fait que les poids soient ouverts, mais la licence elle-même. Beaucoup de modèles ouverts populaires sortent sous leurs propres licences « community », avec des restrictions sur le nombre d'utilisateurs ou les cas d'usage. Apache 2.0 ne comporte pas ce genre de clauses, ce qui fait qu'un modèle américain publié précisément sous cette licence réduit une partie du risque juridique pour les entreprises.
Le duo formé par le grand et le petit modèle (975B-A41B et 276B-A12B) couvre des scénarios différents : le modèle phare pour une qualité maximale, Inkling-Small pour tourner sur du matériel plus modeste.
Ce que cela signifie
Un modèle multimodal ouvert de cette taille venant d'une équipe américaine offre aux développeurs une nouvelle option solide, déployable localement et utilisable commercialement sans clause de licence restrictive. Disposer d'emblée de deux tailles permet de choisir le modèle en fonction du budget de calcul, et pour le marché des poids ouverts, cela signifie une concurrence accrue au-delà des laboratoires chinois.
Questions fréquentes
Qu'est-ce qu'Inkling 975B-A41B ?
C'est le modèle multimodal phare de Thinky, bâti sur une architecture Mixture-of-Experts : 975 milliards de paramètres au total et 41 milliards actifs par requête. Les poids sont ouverts sous licence Apache 2.0.
Inkling est-il gratuit ?
Oui, les poids sont publiés en accès ouvert sous Apache 2.0 : le modèle peut être téléchargé, exécuté et utilisé dans des produits commerciaux gratuitement. Il faut seulement payer pour son propre matériel de calcul ou pour le cloud.
En quoi Inkling-Small diffère-t-il du modèle phare ?
Inkling-Small est plus petit : 276 milliards de paramètres contre 975 milliards, et 12 milliards actifs contre 41 milliards. Il est conçu pour tourner sur du matériel moins puissant, tandis que le modèle phare vise la qualité maximale.
Besoin d'une IA qui travaille dans votre entreprise — pas seulement dans votre fil d'actualité?
Je construis de l'IA en production pour les entreprises — CRM sur mesure, outils internes, agents autonomes, automatisation des processus. Vous en êtes propriétaire, adaptée à votre processus, sans coût par utilisateur. Réalisé par Zhemal Khamidun, CPO d'AlpinaGPT (plateforme IA, 6 000+ utilisateurs).
L'essentiel de l'IA — une fois par semaine
Sept actus qui ont vraiment compté, choisies à la main. Sans bruit ni communiqués.
C'est fait ! Vérifiez votre boîte mail pour la confirmation.