Из Tencent Hunyuan ушёл глава мультимодального ИИ Ху Хань — команда переходит к world models
Ху Хань, руководитель направления мультимодального понимания в Tencent Hunyuan, подал заявление об уходе — он основывает собственный стартап. Об этом сообщило издание «Интеллектуальное возникновение» (36Kr). Ранее Ху Хань был principal researcher в Microsoft Research Asia, а в Tencent пришёл в начале 2025 года. Его бывшую группу глава департамента больших языковых моделей Яо Шуньюй, скорее всего, переориентирует на передовые исследования world models.
Processado por IA de 36Kr (36氪); editado por Hamidun News
Hu Han, responsável pela área de compreensão multimodal na Tencent Hunyuan, pediu demissão para fundar sua própria startup — foi o que informou, em 23 de julho de 2026, o veículo chinês "Emergência Inteligente" (36Kr, 智能涌现). Segundo o veículo, sua antiga equipe de pesquisa na Tencent deve ser redirecionada para o estudo de world models.
Quem é Hu Han
Antes da Tencent, Hu Han era principal researcher no grupo de computação visual da Microsoft Research Asia. Ele entrou na Tencent no início de 2025 e liderou as pesquisas em grandes modelos visuais e, após uma reorganização interna, passou para o grupo de pesquisa avançada "Frontier" do departamento de grandes modelos de linguagem, respondendo a Shunyu Yao.
Segundo a 36Kr, Hu Han era responsável, entre outras coisas, pelo desenvolvimento de world models — sistemas que simulam a realidade física em vez de apenas descrever uma imagem. É justamente essa direção, segundo o veículo, que pode se tornar o novo foco de sua antiga equipe.
Por que a Tencent está reavaliando o multimodal
A Tencent está redirecionando recursos para os modelos de linguagem fundamentais, e as pesquisas em compreensão multimodal estão perdendo prioridade. A precisão no reconhecimento de texto, imagens e vídeo nessa área já ultrapassou 85%, portanto novos investimentos trazem retorno limitado — é o que aponta um pesquisador citado pela 36Kr.
Um papel-chave nessa guinada é desempenhado por Shunyu Yao, ex-pesquisador da OpenAI que passou a chefiar o departamento de grandes modelos de linguagem da Tencent. Após sua chegada, a empresa dissolveu a AI Lab e incorporou os principais desenvolvedores ao departamento de LLM, além de reforçar as contratações — em particular, vindas das equipes de Seed Infra e de pós-treinamento da ByteDance.
- Hu Han pediu demissão e está fundando uma startup (segundo comunicado da 36Kr de 23 de julho de 2026)
- Anteriormente, era principal researcher na Microsoft Research Asia; na Tencent desde o início de 2025
- Seu substituto na área de VLM é Tian Yonglong, ex-pesquisador da OpenAI e PhD pelo MIT, que entrou na Tencent no início de julho de 2026
- O capex (investimento em capital) da Tencent em 2025 foi de 79,2 bilhões de yuans
- Para comparação: a Alibaba investiu 126 bilhões de yuans no ano fiscal encerrado em março de 2026; a ByteDance planeja até US$ 70 bilhões em infraestrutura de IA em 2026 (dados da Bloomberg)
O que importa mais — reconhecimento ou monetização
A compreensão multimodal não se monetiza bem de forma direta, e essa é uma das razões da mudança de prioridades. Os usuários não estão dispostos a pagar por cenários como reconhecimento de imagens ou "descrição de imagem", enquanto pagam pelo processamento de documentos, criação de apresentações e relatórios — porque por trás disso estão as capacidades de raciocínio (reasoning), programação (coding) e agentic do modelo.
"Nenhum usuário está disposto a pagar pelo reconhecimento de imagens — o mercado está cheio de alternativas gratuitas", explicou à 36Kr a lógica da revisão o gerente de produto do aplicativo
Yuanbao.
Shunyu Yao impõe disciplina rígida na nova equipe. Um mês antes do lançamento do modelo Hy3, quando foram encontrados problemas em parte dos dados, segundo o veículo "LatePost", ele avisou a equipe:
"Os dados são extremamente importantes.
Se isso se repetir mais uma vez, será demissão imediata" — Shunyu Yao, chefe do departamento de grandes modelos de linguagem da Tencent.
O que isso significa
A Tencent está deliberadamente desacelerando a direção madura, mas de baixa monetização, da compreensão multimodal, e concentrando talentos e capacidade computacional em modelos fundamentais e temas de fronteira como world models. O primeiro resultado dessa estratégia é o modelo Hy3, de 6 de julho de 2026, que, segundo a avaliação da 36Kr, já compete com GLM-5.2 e DeepSeek V4 Pro na categoria de tamanho médio.
Perguntas frequentes
O que são world models e por que a aposta neles
World models são modelos que aprendem a simular o mundo físico e sua dinâmica, em vez de apenas reconhecer o conteúdo de uma imagem. Na Tencent, essa direção é considerada mais promissora do que a já madura compreensão multimodal, e é justamente para ela, segundo a 36Kr, que a antiga equipe de Hu Han pode migrar.
Quem vai substituir Hu Han na Tencent
A área de modelos visuais-linguísticos (VLM) será liderada por Tian Yonglong — ex-pesquisador da OpenAI e PhD pelo MIT, que entrou no departamento de grandes modelos de linguagem da Tencent no início de julho de 2026 e responde a Shunyu Yao.
O que é o modelo Hy3
Hy3 é um grande modelo de linguagem da Tencent, lançado em 6 de julho de 2026, o primeiro grande resultado de Shunyu Yao na empresa. Segundo a 36Kr, na categoria de tamanho médio ele é comparável a GLM-5.2 e DeepSeek V4 Pro.
Quer parar de ler sobre IA e começar a usar?
AI News é um feed curado de notícias de IA. A Hamidun Academy ensina você a usar IA no trabalho.
O essencial da IA — uma vez por semana
Sete histórias que realmente importaram, escolhidas a dedo. Sem ruído nem releases.
Pronto! Verifique seu e-mail para a confirmação.