Tencent a publié en open source Hunyuan Hy3, un modèle de langage de 295 milliards de paramètres, en diffusant les poids complets sous la licence Apache 2.0 sur Hugging Face, ModelScope et GitCode. Ce lancement fait suite à une version préliminaire que Tencent avait mise en ligne en avril, et il comprend désormais à la fois la version standard et une variante FP8 moins coûteuse à exécuter. Apache 2.0 est une licence permissive qui autorise l'usage commercial, ce qui compte autant que la capacité brute, car cela signifie que les entreprises peuvent développer sur Hy3 sans les restrictions d'utilisation qu'imposent certaines autres licences de modèles.
Le chiffre qui définit le modèle n'est pas vraiment les 295 milliards de paramètres au total, c'est plutôt les 21 milliards environ qui sont actifs à un instant donné. Hy3 est un modèle à mélange d'experts, une architecture qui stocke un très grand ensemble de réseaux spécialisés mais n'en active qu'une petite fraction pour chaque jeton. Le résultat est que le modèle peut porter les connaissances d'un système bien plus grand tout en coûtant beaucoup moins cher à exécuter, plus proche d'un modèle de 21 milliards de paramètres que d'un modèle de 295 milliards. Il est livré avec une fenêtre de contexte de 256K jetons, assez longue pour contenir de vastes bases de code ou ensembles de documents en une seule passe, et la version FP8 réduit encore la mémoire et le calcul nécessaires à son déploiement.
Sur le plan des capacités, Tencent s'appuie sur une évaluation à l'aveugle plutôt que sur le classement habituel de tests automatisés. L'entreprise indique que 270 experts ont noté les modèles concurrents sur des tâches tirées de leur travail quotidien, et Hy3 a atteint 2.67 sur 4, devant GLM-5.1 à 2.51. La société fait état d'une force particulière en raisonnement, en flux de travail agentiques, en tâches à contexte long, en programmation, en productivité de bureau, en modélisation financière, en conception frontend et en développement de jeux, et elle affirme que le modèle rivalise avec des systèmes ouverts phares qui exploitent plusieurs fois plus de paramètres actifs. Le format à l'aveugle, fondé sur le travail réel, est un signal plus significatif qu'un test synthétique, même s'il s'agit toujours du fournisseur qui rapporte son propre résultat.
Il vaut la peine d'être précis sur ce que l'affirmation est et n'est pas. Battre GLM-5.1 dans un test à l'aveugle et dominer sa catégorie de taille est un résultat réel et précis. Rivaliser avec des modèles phares qui ont deux à cinq fois plus de paramètres actifs est un solide argument d'efficacité. Aucun de ces points n'équivaut à surpasser les modèles de frontière fermée des plus grands laboratoires, et Tencent ne le prétend pas vraiment. La lecture honnête est que Hy3 est un modèle capable, efficace et entièrement ouvert qui est très bon pour sa taille active, non pas une déclaration selon laquelle le monde ouvert aurait rattrapé le sommet du monde fermé.
Si cela compte plus qu'une simple sortie, c'est que cela prolonge une tendance qui dure depuis le début de l'année, où de grandes entreprises et laboratoires technologiques chinois continuent de livrer des modèles capables sous des licences véritablement ouvertes et favorables au commerce. Hy3 s'inscrit aux côtés d'une série régulière de sorties à poids ouverts en 2026, et il renforce d'un coup deux des tendances les plus nettes de l'année, le mouvement vers les conceptions à mélange d'experts qui maintiennent le calcul actif bas, et la poussée vers la capacité agentique comme ce que ces modèles sont réglés pour faire. Pour quiconque développe sur des modèles ouverts, un système de 295 milliards de paramètres qui fonctionne comme un modèle de 21 milliards, qui est solide en agents et en contexte long, et qui porte une licence Apache 2.0, est une nouvelle option véritablement utile plutôt qu'une simple entrée de plus sur une liste.
