Открытые против закрытых: GLM-5.2 и DeepSeek V4-Pro отстают уже на 4–7 месяцев
Институт безопасности ИИ Великобритании (AISI) впервые публично измерил, насколько открытые модели отстают от закрытых. Ответ: 4–7 месяцев против 6–10 годом ранее. GLM-5.2 догнала Claude Opus 4.6, а DeepSeek V4-Pro вышла на уровень Opus 4.5 — при этом один прогон кибертеста на ней стоит $1,19 против $85 у Opus.
Traité par IA depuis Import AI (Jack Clark) ; édité par Hamidun News
Le 20 juillet 2026, l'Institut britannique de sécurité de l'IA (AI Security Institute, AISI) a publié la première mesure publique de l'écart entre modèles ouverts et fermés : dans les tâches de cybersécurité, il s'est réduit à 4–7 mois, contre 6–10 mois pendant presque toute l'année 2025.
De combien les modèles ouverts sont-ils en retard
Les modèles ouverts GLM-5.2 et DeepSeek V4-Pro ont obtenu, dans les tests cyber de l'AISI, un résultat équivalent à celui de modèles fermés sortis 4–7 mois plus tôt. C'est la première tentative du régulateur de mesurer cette distance non à vue d'œil, mais sur un ensemble fixe de tâches.
- GLM-5.2 (Zhipu, juin 2026) a rejoint le niveau de Claude Opus 4.6 d'Anthropic (février 2026) — un retard d'environ 4 mois
- DeepSeek V4-Pro a atteint le niveau de Claude Opus 4.5 (novembre 2025)
- La mesure a été réalisée sur un ensemble fixe de tâches de cybersécurité de l'AISI
- Un an plus tôt, pendant la majeure partie de 2025, l'écart se maintenait à 6–10 mois
- Sur les tâches longues à étapes multiples, le retard est plus marqué que sur les tests cyber étroits
«
Les modèles ouverts récents GLM-5.2 et DeepSeek V4-Pro fonctionnent au même niveau que les modèles fermés de pointe sortis 4–7 mois plus tôt », — extrait du rapport analytique de l'AI Security Institute.
Pourquoi c'est important pour la défense
Le principal changement n'est pas tant la vitesse que le prix. Selon l'AISI, une seule exécution du test CyberRange avec un quota de 100 millions de tokens coûte environ 85 $ sur Claude Opus 4.5 ou 4.6, environ 46 $ sur GLM-5.2, et seulement 1,19 $ sur DeepSeek V4-Pro.
Un écart de plusieurs dizaines de fois signifie que des capacités cyber comparables deviennent accessibles à un coût nettement inférieur — et se retrouvent dans des modèles ouverts, qui disposent généralement de moins de garde-fous (safeguards) que les modèles fermés.
«
Des capacités avancées atteignent des modèles ouverts moins protégés plus vite qu'auparavant », — indique le communiqué de l'AI Security Institute.
Kimi K3 et le plan de Hassabis
Jack Clark renforce la même tendance dans la newsletter Import AI avec deux autres signaux. Le premier est l'annonce de Kimi K3 par Moonshot AI : un modèle de 2,8 billions de paramètres, dont l'entreprise promet de publier les poids et l'article scientifique dans les prochaines semaines. Selon la description d'Import AI, lors d'une seule exécution autonome de 48 heures, K3 a conçu, optimisé et vérifié une puce, tout en construisant également le compilateur MiniTriton.
Le second signal est une proposition réglementaire de Demis Hassabis, cofondateur de DeepMind. Il propose de créer un Standards Body sectoriel sur le modèle du régulateur financier américain FINRA : les entreprises soumettraient volontairement tout nouveau modèle à un examen 30 jours avant sa sortie, et ce régime volontaire serait, à terme, inscrit dans la loi.
«
Le Standards Body sera chargé d'élaborer des protocoles d'évaluation et d'assurer l'interaction avec les agences fédérales concernées », — Demis Hassabis, cofondateur de DeepMind, dans une publication sur X.
Ce que cela signifie
Les modèles ouverts cessent d'être « ceux qui rattrapent leur retard un an après ». Un écart de 4–7 mois combiné à un coût d'inférence des dizaines de fois inférieur déplace l'équilibre : les capacités de pointe se diffusent plus vite vers des modèles moins protégés, et c'est précisément pour cela que des propositions comme le régulateur sectoriel de Hassabis se retrouvent sur la table.
Questions fréquentes
Qu'est-ce que l'écart entre modèles ouverts et fermés ?
C'est le temps de retard des meilleurs modèles ouverts par rapport aux modèles fermés sur des tâches précises. Selon la mesure de l'AISI du 20 juillet 2026, en cybersécurité il est de 4–7 mois, contre 6–10 mois un an plus tôt.
De combien les modèles ouverts sont-ils moins chers ?
Dans le test CyberRange de l'AISI, une exécution sur DeepSeek V4-Pro a coûté 1,19 $, sur GLM-5.2 environ 46 $, et sur les modèles fermés Claude Opus 4.5 et 4.6 environ 85 $, pour le même quota de 100 millions de tokens.
Que propose Demis Hassabis ?
Créer un Standards Body sur le modèle de la FINRA : soumission volontaire des modèles à un examen 30 jours avant leur sortie, avec une transformation ultérieure de ces règles en loi.
Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?
AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.
L'essentiel de l'IA — une fois par semaine
Sept actus qui ont vraiment compté, choisies à la main. Sans bruit ni communiqués.
C'est fait ! Vérifiez votre boîte mail pour la confirmation.