36Kr (36氪)→ оригинал

Из Tencent Hunyuan ушёл глава мультимодального ИИ Ху Хань — команда переходит к world models

Ху Хань, руководитель направления мультимодального понимания в Tencent Hunyuan, подал заявление об уходе — он основывает собственный стартап. Об этом сообщило издание «Интеллектуальное возникновение» (36Kr). Ранее Ху Хань был principal researcher в Microsoft Research Asia, а в Tencent пришёл в начале 2025 года. Его бывшую группу глава департамента больших языковых моделей Яо Шуньюй, скорее всего, переориентирует на передовые исследования world models.

AI-обработка оригинала 36Kr (36氪); редакция Hamidun News
Из Tencent Hunyuan ушёл глава мультимодального ИИ Ху Хань — команда переходит к world models
Источник: 36Kr (36氪). Коллаж: Hamidun News.
◐ Слушать статью

Ху Хань, руководитель направления мультимодального понимания в Tencent Hunyuan, подал заявление об уходе, чтобы основать собственный стартап — об этом 23 июля 2026 года сообщило китайское издание «Интеллектуальное возникновение» (36Kr, 智能涌现). Его прежнюю исследовательскую группу в Tencent, по данным издания, планируют переориентировать на изучение world models.

Кто такой Ху Хань

Ху Хань до Tencent был главным исследователем (principal researcher) в группе визуальных вычислений Microsoft Research Asia. В Tencent он пришёл в начале 2025 года и возглавил исследования визуальных больших моделей, а после внутренней реорганизации перешёл в передовую исследовательскую группу «Frontier» департамента больших языковых моделей и стал подчиняться Яо Шуньюй.

Ху Хань, по информации 36Kr, отвечал в том числе за разработку world models — систем, которые моделируют физическую реальность, а не просто описывают картинку. Именно это направление, как считает издание, может стать новым фокусом его бывшей команды.

Почему Tencent пересматривает мультимодалку

Tencent перераспределяет ресурсы в пользу базовых языковых моделей, и исследования мультимодального понимания теряют приоритет. Точность распознавания текста, изображений и видео в этой области уже превысила 85%, поэтому дальнейшие вложения дают ограниченную отдачу — на это указывает цитируемый 36Kr исследователь.

Ключевую роль в развороте играет Яо Шуньюй, экс-исследователь OpenAI, возглавивший департамент больших языковых моделей Tencent. После его прихода компания расформировала AI Lab и влила основных разработчиков в департамент LLM, а также усилила наём — в частности, из команд Seed Infra и пост-тренинга ByteDance.

  • Ху Хань подал заявление об уходе, основывает стартап (сообщение 36Kr от 23 июля 2026 года)
  • Ранее — principal researcher в Microsoft Research Asia, в Tencent с начала 2025 года
  • Замена на направлении VLM — Тянь Юнлун, экс-OpenAI и PhD MIT, пришёл в Tencent в начале июля 2026 года
  • Капитальные затраты Tencent за 2025 год — 79,2 млрд юаней
  • Для сравнения: Alibaba — 126 млрд юаней за финансовый год до марта 2026-го; ByteDance планирует до $70 млрд на AI-инфраструктуру в 2026 году (данные Bloomberg)

Что важнее — распознавание или монетизация

Mультимодальное понимание плохо монетизируется напрямую, и это одна из причин смены приоритетов. Сценарии вроде распознавания картинок или «описания по изображению» пользователи не готовы оплачивать, тогда как за обработку документов, создание презентаций и отчётов — платят, потому что за ними стоят reasoning, кодинг и agentic-возможности модели.

«Ни один пользователь не готов платить за распознавание изображений — на рынке полно бесплатных аналогов», — так продакт-менеджер приложения

Yuanbao объяснил 36Kr логику пересмотра.

Дисциплину в новой команде Яо Шуньюй задаёт жёстко. За месяц до выпуска модели Hy3, когда обнаружились проблемы с частью данных, он, по информации издания «LatePost», предупредил команду:

«Данные крайне важны.

Если такое повторится ещё раз — сразу увольнение», — Яо Шуньюй, руководитель департамента больших языковых моделей Tencent.

Что это значит

Tencent осознанно тормозит зрелое, но слабо монетизируемое направление мультимодального понимания и стягивает таланты и вычислительные мощности к базовым моделям и передовым темам вроде world models. Первый результат стратегии — модель Hy3 от 6 июля 2026 года, которая, по оценке 36Kr, уже конкурирует с GLM-5.2 и DeepSeek V4 Pro в среднем размерном классе.

Частые вопросы

Что такое world models и почему на них делают ставку

World models — это модели, которые учатся моделировать физический мир и его динамику, а не просто распознавать содержимое картинки. В Tencent это направление считают более перспективным, чем зрелое мультимодальное понимание, и именно на него, по данным 36Kr, может переключиться бывшая группа Ху Ханя.

Кто заменит Ху Ханя в Tencent

Направление визуально-языковых моделей (VLM) возглавит Тянь Юнлун — бывший исследователь OpenAI и PhD MIT, который пришёл в департамент больших языковых моделей Tencent в начале июля 2026 года и подчиняется Яо Шуньюй.

Что за модель Hy3

Hy3 — большая языковая модель Tencent, выпущенная 6 июля 2026 года, первый крупный результат Яо Шуньюй в компании. По оценке 36Kr, в среднем размерном классе она сопоставима с GLM-5.2 и DeepSeek V4 Pro.

ЖХ
Hamidun News
AI‑новости без шума. Ежедневный редакторский отбор из 50+ источников. Продукт Жемала Хамидуна, Head of AI в Alpina Digital.

Хотите не читать про ИИ, а внедрить его?

«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.

Что вы думаете?
Загружаем комментарии…