3DNews AI→ original

MiniMax développe le plus grand LLM ouvert du monde avec 2,7 billions de paramètres

La startup d'IA chinoise MiniMax développe un grand modèle de langage de 2,7 billions de paramètres, rapporte Reuters citant une source informée. C'est le plus grand modèle aux poids ouverts lancé par une entreprise chinoise et probablement le plus grand au monde à ce jour.

Traité par IA depuis 3DNews AI ; édité par Hamidun News
MiniMax développe le plus grand LLM ouvert du monde avec 2,7 billions de paramètres
Source : 3DNews AI. Collage: Hamidun News.
◐ Écouter l'article

La startup d'IA chinoise MiniMax développe un grand modèle de langage avec 2,7 trillions de paramètres, rapporte Reuters en citant une source informée. C'est le plus grand modèle d'IA aux poids ouverts publié par une entreprise chinoise, et probablement le plus grand modèle ouvert du monde.

Quelle est réellement la taille du modèle MiniMax

2,7 trillions de paramètres — un chiffre qui place le futur modèle MiniMax dans les plus hauts échelons des modèles de langage connus par taille déclarée. Pour comparaison : le DeepSeek chinois, dont le modèle DeepSeek V3 (671 milliards de paramètres) a un jour fait sensation sur le marché des modèles d'IA ouverts, travaille avec un modèle près de quatre fois plus petit en nombre de paramètres que celui en cours de développement par MiniMax.

  • Développeur — startup d'IA chinoise MiniMax
  • Taille du modèle déclarée — 2,7 trillions de paramètres
  • Source d'information — Reuters citant une source informée
  • Le modèle est présenté comme le plus grand modèle d'IA ouvert publié par une entreprise chinoise

Qui est MiniMax et pourquoi vous devriez le savoir

MiniMax est l'un des soi-disant "six tigres" chinois de startups d'IA fondées à Shanghai et publiant leurs propres grands modèles de langage, de voix et de vidéo sous les marques abab et MiniMax-01/M-series. L'entreprise a déjà publié des modèles ouverts et des services API pour la génération de texte, de parole et de vidéo et concurrence au sein de la Chine avec DeepSeek, Alibaba (ligne de modèles Qwen), Moonshot AI (Kimi) et Zhipu AI. Le développement d'un modèle d'une telle échelle que 2,7 trillions de paramètres nécessite une puissance de calcul significative et témoigne des ambitions sérieuses de l'entreprise de s'établir dans les plus hauts échelons des laboratoires d'IA mondiaux, pas seulement le marché chinois interne.

Pourquoi la course à la taille du modèle s'est intensifiée à nouveau

Les grands modèles de langage d'une telle échelle sont presque toujours construits sur l'architecture MoE (mélange d'experts), où seule une partie du nombre total de paramètres est impliquée dans le traitement de chaque requête spécifique — cela permet de mettre à l'échelle la taille totale du modèle sans augmentation proportionnelle des coûts informatiques pour l'inférence. La course au nombre de paramètres parmi les laboratoires d'IA chinois est devenue l'un des principaux fronts de la compétition avec les laboratoires américains sur le marché des poids ouverts : après que les modèles ouverts de DeepSeek aient fait une impression sérieuse sur l'industrie avec leur rapport qualité-coût de formation, l'intérêt pour les modèles ouverts chinois a décollé parmi les développeurs du monde entier à la recherche d'une alternative aux API fermées d'OpenAI, Anthropic et Google.

Les poids ouverts signifient qu'après la publication, le modèle peut être téléchargé, ajusté pour vos propres tâches et exécuté sur votre propre infrastructure sans dépendance à l'égard de l'API d'un fournisseur spécifique — c'est ainsi que les laboratoires chinois se différencient fondamentalement de la plupart des principaux développeurs américains, qui gardent les poids des modèles phares fermés.

Ce que cela signifie

Si les données de Reuters sont confirmées, MiniMax consolide son statut de développeur du plus grand modèle de langage open source du monde — un autre signal indiquant que ce sont les laboratoires d'IA chinois, et non les laboratoires américains, qui donnent actuellement le rythme dans la course à la mise à l'échelle des modèles aux poids ouverts.

ZK
Hamidun News
Actualités IA sans bruit. Sélection éditoriale quotidienne de plus de 50 sources. Produit de Zhemal Khamidun, Head of AI chez Alpina Digital.

Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?

AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.

Qu'en pensez-vous ?
Chargement des commentaires…