Из Tencent Hunyuan ушёл глава мультимодального ИИ Ху Хань — команда переходит к world models
Ху Хань, руководитель направления мультимодального понимания в Tencent Hunyuan, подал заявление об уходе — он основывает собственный стартап. Об этом сообщило издание «Интеллектуальное возникновение» (36Kr). Ранее Ху Хань был principal researcher в Microsoft Research Asia, а в Tencent пришёл в начале 2025 года. Его бывшую группу глава департамента больших языковых моделей Яо Шуньюй, скорее всего, переориентирует на передовые исследования world models.
Traité par IA depuis 36Kr (36氪) ; édité par Hamidun News
Hu Han, responsable de la compréhension multimodale chez Tencent Hunyuan, a déposé sa démission pour fonder sa propre startup — c'est ce qu'a rapporté, le 23 juillet 2026, le média chinois « Émergence Intelligente » (36Kr, 智能涌现). Selon ce média, son ancienne équipe de recherche chez Tencent devrait être réorientée vers l'étude des world models.
Qui est Hu Han
Avant Tencent, Hu Han était principal researcher au sein du groupe de calcul visuel de Microsoft Research Asia. Il a rejoint Tencent début 2025 et a dirigé les recherches sur les grands modèles visuels, avant de passer, après une réorganisation interne, au groupe de recherche avancée « Frontier » du département des grands modèles de langage, sous la responsabilité de Shunyu Yao.
Selon 36Kr, Hu Han était notamment responsable du développement des world models — des systèmes qui modélisent la réalité physique plutôt que de simplement décrire une image. C'est précisément cette direction, selon le média, qui pourrait devenir le nouveau point focal de son ancienne équipe.
Pourquoi Tencent révise son approche du multimodal
Tencent redéploie ses ressources vers les modèles de langage fondamentaux, et la recherche sur la compréhension multimodale perd en priorité. La précision de la reconnaissance de texte, d'images et de vidéo dans ce domaine a déjà dépassé 85 %, si bien que de nouveaux investissements n'apportent qu'un retour limité — c'est ce que souligne un chercheur cité par 36Kr.
Shunyu Yao, ancien chercheur d'OpenAI devenu directeur du département des grands modèles de langage de Tencent, joue un rôle clé dans ce virage. Après son arrivée, l'entreprise a dissous l'AI Lab et intégré ses principaux développeurs au département LLM, tout en renforçant ses recrutements — notamment issus des équipes Seed Infra et post-entraînement de ByteDance.
- Hu Han a déposé sa démission et fonde une startup (selon un rapport de 36Kr du 23 juillet 2026)
- Auparavant principal researcher chez Microsoft Research Asia ; chez Tencent depuis début 2025
- Son remplaçant sur le volet VLM est Tian Yonglong, ancien chercheur d'OpenAI et titulaire d'un PhD du MIT, arrivé chez Tencent début juillet 2026
- Les dépenses d'investissement (capex) de Tencent pour 2025 se sont élevées à 79,2 milliards de yuans
- À titre de comparaison : Alibaba a dépensé 126 milliards de yuans pour l'exercice fiscal clos en mars 2026 ; ByteDance prévoit jusqu'à 70 milliards de dollars d'investissement dans les infrastructures IA en 2026 (données Bloomberg)
Qu'est-ce qui compte le plus — la reconnaissance ou la monétisation
La compréhension multimodale se monétise mal directement, et c'est l'une des raisons de ce changement de priorités. Les utilisateurs ne sont pas prêts à payer pour des scénarios comme la reconnaissance d'images ou la « description d'image », alors qu'ils paient pour le traitement de documents, la création de présentations et de rapports, car ces usages reposent sur les capacités de raisonnement, de codage et agentic du modèle.
«
Aucun utilisateur n'est prêt à payer pour la reconnaissance d'images — le marché regorge d'alternatives gratuites », a expliqué à 36Kr le chef de produit de l'application Yuanbao pour justifier cette révision.
Shunyu Yao impose une discipline stricte à la nouvelle équipe. Un mois avant la sortie du modèle Hy3, alors que des problèmes avaient été détectés sur une partie des données, il aurait averti l'équipe, selon le média « LatePost » :
« Les données sont extrêmement importantes.
Si cela se reproduit, ce sera un licenciement immédiat » — Shunyu Yao, directeur du département des grands modèles de langage de Tencent.
Ce que cela signifie
Tencent freine délibérément l'axe mature, mais peu rentable, de la compréhension multimodale, et concentre ses talents et sa puissance de calcul sur les modèles fondamentaux et des sujets de pointe comme les world models. Le premier résultat de cette stratégie est le modèle Hy3, sorti le 6 juillet 2026, qui, selon l'évaluation de 36Kr, rivalise déjà avec GLM-5.2 et DeepSeek V4 Pro dans la catégorie de taille moyenne.
Questions fréquentes
Que sont les world models et pourquoi
Tencent mise-t-il sur eux
Les world models sont des modèles qui apprennent à simuler le monde physique et sa dynamique, plutôt que de simplement reconnaître le contenu d'une image. Chez Tencent, cette direction est jugée plus prometteuse que la compréhension multimodale, déjà mature, et c'est précisément vers elle, selon 36Kr, que pourrait se réorienter l'ancienne équipe de Hu Han.
Qui va remplacer Hu Han chez Tencent
La direction des modèles visuo-linguistiques (VLM) sera confiée à Tian Yonglong — ancien chercheur d'OpenAI et titulaire d'un PhD du MIT, arrivé au département des grands modèles de langage de Tencent début juillet 2026, sous la responsabilité de Shunyu Yao.
Qu'est-ce que le modèle Hy3
Hy3 est un grand modèle de langage de Tencent, sorti le 6 juillet 2026, premier résultat majeur de Shunyu Yao au sein de l'entreprise. Selon 36Kr, dans la catégorie de taille moyenne, il est comparable à GLM-5.2 et DeepSeek V4 Pro.
Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?
AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.
L'essentiel de l'IA — une fois par semaine
Sept actus qui ont vraiment compté, choisies à la main. Sans bruit ni communiqués.
C'est fait ! Vérifiez votre boîte mail pour la confirmation.