Из Tencent Hunyuan ушёл глава мультимодального ИИ Ху Хань — команда переходит к world models
Ху Хань, руководитель направления мультимодального понимания в Tencent Hunyuan, подал заявление об уходе — он основывает собственный стартап. Об этом сообщило издание «Интеллектуальное возникновение» (36Kr). Ранее Ху Хань был principal researcher в Microsoft Research Asia, а в Tencent пришёл в начале 2025 года. Его бывшую группу глава департамента больших языковых моделей Яо Шуньюй, скорее всего, переориентирует на передовые исследования world models.
Procesado por IA desde 36Kr (36氪); editado por Hamidun News
Hu Han, responsable del área de comprensión multimodal en Tencent Hunyuan, ha presentado su renuncia para fundar su propia startup — así lo informó el 23 de julio de 2026 el medio chino "Emergencia Inteligente" (36Kr, 智能涌现). Según el medio, su antiguo equipo de investigación en Tencent será reorientado hacia el estudio de world models.
Quién es Hu Han
Antes de Tencent, Hu Han fue principal researcher en el grupo de computación visual de Microsoft Research Asia. Se incorporó a Tencent a principios de 2025 y lideró la investigación de grandes modelos visuales, y tras una reorganización interna pasó al grupo de investigación avanzada "Frontier" del departamento de grandes modelos de lenguaje, reportando a Shunyu Yao.
Según 36Kr, Hu Han era responsable, entre otras cosas, del desarrollo de world models — sistemas que simulan la realidad física en lugar de limitarse a describir una imagen. Precisamente esta dirección, según el medio, podría convertirse en el nuevo foco de su antiguo equipo.
Por qué Tencent está replanteando lo multimodal
Tencent está redistribuyendo recursos hacia los modelos de lenguaje fundacionales, y la investigación en comprensión multimodal pierde prioridad. La precisión en el reconocimiento de texto, imágenes y video en esta área ya ha superado el 85%, por lo que nuevas inversiones producen un retorno limitado — así lo señala un investigador citado por 36Kr.
Un papel clave en este giro lo desempeña Shunyu Yao, exinvestigador de OpenAI que ahora dirige el departamento de grandes modelos de lenguaje de Tencent. Tras su llegada, la compañía disolvió AI Lab e integró a sus desarrolladores principales en el departamento de LLM, además de reforzar la contratación — en particular, desde los equipos de Seed Infra y post-entrenamiento de ByteDance.
- Hu Han ha presentado su renuncia y funda una startup (según un informe de 36Kr del 23 de julio de 2026)
- Antes fue principal researcher en Microsoft Research Asia; en Tencent desde principios de 2025
- Su reemplazo en la dirección de VLM es Tian Yonglong, exinvestigador de OpenAI y PhD por el MIT, incorporado a Tencent a principios de julio de 2026
- El gasto de capital (capex) de Tencent en 2025 fue de 79,2 mil millones de yuanes
- Para comparar: Alibaba gastó 126 mil millones de yuanes en el año fiscal cerrado en marzo de 2026; ByteDance planea invertir hasta $70 mil millones en infraestructura de IA en 2026 (datos de Bloomberg)
Qué importa más — el reconocimiento o la monetización
La comprensión multimodal no se monetiza bien de forma directa, y esta es una de las razones del cambio de prioridades. Los usuarios no están dispuestos a pagar por escenarios como el reconocimiento de imágenes o la "descripción de imágenes", mientras que sí pagan por el procesamiento de documentos, la creación de presentaciones e informes, porque detrás de ello están las capacidades de razonamiento, programación y agentic del modelo.
"Ningún usuario está dispuesto a pagar por el reconocimiento de
imágenes: el mercado está lleno de alternativas gratuitas", así explicó a 36Kr la lógica de este replanteamiento el product manager de la aplicación Yuanbao.
Shunyu Yao impone una disciplina estricta en el nuevo equipo. Un mes antes del lanzamiento del modelo Hy3, cuando se detectaron problemas con parte de los datos, según el medio "LatePost" advirtió al equipo:
"Los datos son extremadamente importantes.
Si esto vuelve a ocurrir, será un despido inmediato" — Shunyu Yao, responsable del departamento de grandes modelos de lenguaje de Tencent.
Qué significa esto
Tencent está frenando de forma deliberada la dirección madura, pero de baja monetización, de la comprensión multimodal, y está concentrando talento y capacidad de cómputo en los modelos fundacionales y en temas de vanguardia como los world models. El primer resultado de esta estrategia es el modelo Hy3, del 6 de julio de 2026, que, según la valoración de 36Kr, ya compite con GLM-5.2 y DeepSeek V4 Pro en la categoría de tamaño medio.
Preguntas frecuentes
Qué son los world models y por qué se apuesta por ellos
Los world models son modelos que aprenden a simular el mundo físico y su dinámica, en lugar de limitarse a reconocer el contenido de una imagen. En Tencent consideran esta dirección más prometedora que la ya madura comprensión multimodal, y es precisamente hacia ahí, según 36Kr, hacia donde podría reorientarse el antiguo equipo de Hu Han.
Quién reemplazará a Hu Han en Tencent
La dirección de modelos visuales-lingüísticos (VLM) quedará a cargo de Tian Yonglong, exinvestigador de OpenAI y PhD por el MIT, que se incorporó al departamento de grandes modelos de lenguaje de Tencent a principios de julio de 2026 y reporta a Shunyu Yao.
Qué es el modelo Hy3
Hy3 es un gran modelo de lenguaje de Tencent, lanzado el 6 de julio de 2026, el primer gran resultado de Shunyu Yao en la compañía. Según 36Kr, en la categoría de tamaño medio es comparable a GLM-5.2 y DeepSeek V4 Pro.
¿Quieres dejar de leer sobre IA y empezar a usarla?
AI News es un feed curado de noticias de IA. Hamidun Academy te enseña a usar la IA en tu trabajo.
Lo esencial de la IA — una vez por semana
Siete historias que de verdad importaron, elegidas a mano. Sin ruido ni notas de prensa.
¡Listo! Revisa tu correo para la confirmación.