Tencent Hy4 affiche 770 milliards de paramètres, mais n’en active que 49 milliards à la fois
Un modèle de 770 milliards de paramètres, capable d’absorber plus d’un million de tokens tout en n’en mobilisant que 49 milliards à chaque passage : avec Hy4 preview, Tencent répond aux grands modèles occidentaux par une architecture géante, mais sélective. L’enjeu ne se limite pas à la taille affichée : il porte sur la capacité de la Chine à diffuser un modèle avancé sous forme ouverte et à l’intégrer directement dans ses produits.
Tencent mise sur une architecture géante, mais parcimonieuse
Le 28 août 2026, Tencent a publié en open source la version preview de Hy4, un modèle doté de 770 milliards de paramètres au total. Ce volume le place dans la catégorie des modèles les plus imposants jamais rendus accessibles publiquement.
Cette taille ne signifie toutefois pas que les 770 milliards de paramètres sont sollicités pour chaque requête. Hy4 repose sur une architecture mixture-of-experts (MoE), qui répartit le traitement entre plusieurs sous-réseaux spécialisés. Un mécanisme de routage sélectionne les experts les plus pertinents selon la demande, avec seulement 49 milliards de paramètres activés à chaque passage.
Cette conception répond à une contrainte centrale des modèles géants : augmenter leur capacité sans multiplier dans les mêmes proportions le coût de chaque inférence. Hy4 conserve une réserve de connaissances et de compétences très large, tout en limitant la quantité de calcul mobilisée pour une requête donnée.
La nuance reste importante. Les 770 milliards de paramètres doivent toujours être stockés et distribués sur une infrastructure adaptée. L’activation parcimonieuse réduit la charge de calcul, mais ne supprime ni les besoins en mémoire, ni les contraintes de bande passante, ni les coûts liés au déploiement d’un tel système.
Plus d’un million de tokens pour travailler sur des corpus massifs
L’autre caractéristique mise en avant par Tencent est la fenêtre de contexte de Hy4, qui dépasse un million de tokens. Cette capacité permet théoriquement de traiter de très longs dépôts de code, des ensembles de documents administratifs, des dossiers scientifiques ou plusieurs semaines d’échanges au sein d’un même contexte.
Pour les entreprises, le bénéfice potentiel est concret : moins de découpage manuel des documents, davantage de continuité dans l’analyse et la possibilité de croiser des sources volumineuses en une seule session. Dans le développement logiciel, un modèle disposant d’un tel contexte peut examiner une large partie d’un projet plutôt qu’un fichier isolé. Dans la recherche scientifique, il peut exploiter simultanément des articles, des notes expérimentales et des jeux de données documentés en langage naturel.
Une fenêtre de contexte élevée ne garantit cependant pas que chaque information sera correctement retrouvée ou utilisée. La qualité dépend de la capacité du modèle à hiérarchiser les éléments pertinents au milieu d’un volume considérable de texte. Les performances réelles devront donc être évaluées sur des tests de long-context reasoning, et pas seulement sur la taille théorique de la fenêtre.
Une réponse chinoise au modèle fermé occidental
Avec Hy4, Tencent s’inscrit dans la compétition mondiale autour des modèles à très grande échelle, dominée par des acteurs américains proposant souvent des systèmes propriétaires accessibles principalement par API. La publication en open source vise à donner aux chercheurs, aux développeurs et aux entreprises un accès plus direct à l’architecture et au modèle.
Cette stratégie présente un intérêt particulier pour l’écosystème chinois. Elle peut favoriser l’évaluation indépendante, l’adaptation à des secteurs spécialisés et le déploiement sur des infrastructures contrôlées localement. Elle permet aussi à Tencent de transformer un modèle de recherche en plateforme technique utilisée par une communauté de développeurs.
Le label open source ne suffit toutefois pas à déterminer le degré réel d’ouverture. La licence, les conditions de redistribution, la disponibilité des poids, la documentation d’entraînement et les éventuelles restrictions commerciales seront déterminantes. Ces éléments permettront de mesurer la portée pratique de l’annonce au-delà du nombre de paramètres.
Aucun score de référence détaillé n’est mis en avant dans les éléments communiqués par Tencent. Il serait donc prématuré de conclure à une supériorité de Hy4 sur les modèles concurrents. Sa taille et sa fenêtre de contexte sont significatives, mais elles ne remplacent ni les évaluations de raisonnement, ni les tests de génération de code, ni les mesures de fiabilité et de sécurité.
Du modèle ouvert aux produits de Tencent
Tencent ne réserve pas Hy4 aux seuls chercheurs. Le groupe l’intègre également à plusieurs services : WorkBuddy, CodeBuddy, Yuanbao et son API.
Cette distribution donne à l’annonce une dimension commerciale immédiate. WorkBuddy peut servir de point d’entrée pour les tâches de bureautique, tandis que CodeBuddy cible directement les développeurs. Yuanbao fournit une interface grand public, et l’API permet aux entreprises d’intégrer Hy4 à leurs propres applications.
Tencent propose par ailleurs un accès gratuit pendant deux semaines sur certains services. Cette période d’essai doit permettre de mesurer l’adoption, mais aussi de recueillir des données d’usage sur les requêtes longues, la génération de code et les tâches documentaires. Elle constitue un test à grande échelle de la capacité de l’infrastructure Tencent à servir un modèle dont le nombre total de paramètres reste exceptionnel.
Le vrai test sera celui de l’usage
L’intérêt de Hy4 dépendra moins de son annonce que de son comportement en production. Les utilisateurs devront vérifier si le modèle conserve une bonne précision lorsque le contexte dépasse plusieurs centaines de milliers de tokens, s’il sait citer les bons passages et si le temps de réponse reste acceptable.
Le coût sera un autre facteur décisif. Les 49 milliards de paramètres actifs peuvent rendre l’inférence plus efficace qu’avec un modèle dense de taille comparable, mais les requêtes dépassant le million de tokens sollicitent fortement la mémoire et le stockage du contexte. Pour une entreprise, la question ne sera donc pas seulement « combien de paramètres sont activés ? », mais aussi « combien coûte une session complète et quel délai faut-il attendre ? ».
Une démonstration technique, avant une validation industrielle
Hy4 preview montre que Tencent entend rivaliser sur les deux axes qui structurent désormais la course aux modèles avancés : la capacité brute et l’efficacité du calcul. Avec 770 milliards de paramètres, 49 milliards activés par passage et une fenêtre supérieure à un million de tokens, le modèle affiche une combinaison ambitieuse.
Le prochain jalon sera la validation par les utilisateurs et les évaluateurs indépendants : qualité sur le code, robustesse en recherche scientifique, précision sur les documents longs, licence réellement exploitable et coût d’accès via l’API. La fin de la période gratuite de deux semaines, autour de la mi-septembre 2026 selon le calendrier annoncé, fournira un premier indicateur d’adoption. C’est à ce moment que Hy4 pourra être jugé non plus sur sa fiche technique, mais sur sa capacité à devenir un outil quotidien face aux modèles occidentaux propriétaires et aux autres initiatives ouvertes.
Sources : Tencent — Hy4 preview, Tencent Newsroom.