Tencent Hy3 : 295 milliards de paramètres, licence Apache
Tencent a lancé Hy3, un modèle Mixture-of-Experts de 295 milliards de paramètres au total (21 milliards actifs) sous licence Apache 2.0. Le modèle s’appuie sur les retours de plus de 50 produits internes après une preview en avril, et selon l’entreprise, il surpasse des modèles de taille comparable et se rapproche des grands modèles open-source de référence. Il dispose d’un contexte de 256K tokens et pèse 598 GB en version complète, 300 GB quantifié en FP8.
Pourquoi ça te concerne. C’est l’une des premières options ouvertes de cette envergure provenant d’un acteur chinois, avec une licence qui te permet de l’utiliser, de le modifier et de le déployer en production sans restrictions. Si tu travailles dans un contexte où l’auto-hébergement est obligatoire (données sensibles, secteur régulé, indépendance totale vis-à-vis des API externes), Hy3 figure parmi les alternatives de premier choix face à Llama ou Mistral Large. La taille active (21B) le rend plus viable qu’il n’y paraît : il fonctionne sur des infrastructures raisonnables, pas besoin d’un datacenter.
Si tu veux l’essayer. Hy3 est disponible sur Hugging Face et gratuitement sur OpenRouter jusqu’au 21 juillet. Tu peux le tester immédiatement via API sans rien télécharger, pour vérifier si les performances sur des tâches réelles (résumé long, traduction technique, génération structurée) justifient la mise en place pour l’exécuter localement. Le poids du modèle quantifié (300 GB) exige néanmoins des GPU dédiés ou des instances cloud disposant de suffisamment de mémoire.