Modèles IA
Tencent ouvre Hy4 preview avec 770B paramètres et un contexte d’un million de tokens
Tencent a publié et ouvert Hy4 preview, un nouveau grand modèle Hunyuan avec 770B paramètres au total, 49B paramètres actifs et une fenêtre de contexte supérieure à un million de tokens.
Tencent a publié et ouvert Hy4 preview, plaçant son nouveau modèle Hunyuan dans la course rapide aux modèles ouverts en Chine. Dans une annonce officielle datée du 28 août 2026, l’entreprise indique que Hy4 preview compte 770 milliards de paramètres au total, active 49 milliards de paramètres par token et prend en charge une fenêtre de contexte dépassant un million de tokens.
Le lancement vise clairement le travail productif plutôt qu’une simple démonstration de benchmark. Tencent affirme que le modèle est conçu pour le codage, le travail de bureau, l’analyse, le développement de jeux et la recherche scientifique. Hy4 preview est disponible comme modèle ouvert et arrive aussi dans des produits Tencent tels que WorkBuddy, CodeBuddy, Yuanbao et ima. Les développeurs peuvent l’utiliser via Tencent Cloud TokenHub et OpenRouter, tandis que WorkBuddy et CodeBuddy offriront deux semaines d’essai gratuit. L’accès gratuit à Hy3 dans ces produits est prolongé jusqu’au 30 septembre.
Les spécifications montrent à quelle vitesse le marché des modèles ouverts monte en échelle. Un modèle mixture-of-experts de 770B paramètres n’est pas destiné à tourner facilement sur du matériel grand public. Mais le nombre de paramètres actifs signifie que chaque token n’utilise qu’une partie du réseau. La fenêtre de contexte d’un million de tokens est particulièrement importante pour les longs projets logiciels, les grands corpus documentaires et les analyses multi-fichiers, où garder davantage de matière en contexte peut compter autant que le raisonnement.
Tencent dit avoir étendu Hy4 preview en taille de modèle, longueur de contexte et volume de données, avec des gains issus du pré-entraînement et du post-entraînement. L’entreprise affirme aussi avoir construit des données avec des experts internes en ingénierie logicielle, jeux, finance et sécurité. Cette approche reflète le déplacement du secteur, qui passe de benchmarks génériques de conversation à des workflows réels: déboguer, relire, préparer des rapports, coordonner des fichiers et transformer l’analyse en documents, feuilles de calcul ou présentations.
L’annonce met en avant une évaluation aveugle interne impliquant 163 experts et 203 tâches d’ingénierie. Selon Tencent, Hy4 preview a obtenu une moyenne de 2,99 sur 4,00, légèrement devant GLM-5.3 et Kimi K3. Comme il s’agit d’une évaluation interne, les développeurs externes devront tester le modèle sur leurs propres charges avant de conclure. Mais ces chiffres montrent que Tencent place Hy4 preview face aux principaux modèles ouverts chinois.
L’un des points les plus inhabituels est que Hy4 preview aurait contribué à son propre développement. Tencent affirme que le modèle a participé pour la première fois à l’optimisation automatique des méthodes d’entraînement, des stratégies de données, des cadres d’évaluation et des opérateurs bas niveau, en réutilisant code, journaux et retours d’expérience. L’entreprise dit aussi que le modèle a analysé les goulots d’étranglement d’inférence et amélioré la fusion d’opérateurs et les communications, augmentant le débit de bout en bout de 31,8% par rapport à une base de référence.
Le prix complète la stratégie. Tencent indique des tarifs API de 0,834 dollar par million de tokens d’entrée, 2,501 dollars par million de tokens de sortie et 0,042 dollar par million de tokens servis depuis le cache. Hy4 preview rejoint ainsi la compétition visant à rendre les modèles avancés à long contexte assez abordables pour le travail quotidien. D’autres modèles Hy4 sont attendus bientôt, ce qui fait de cette preview à la fois un produit et une étape de retour d’expérience.