Qwen3 Coder Next (80B) en déploiement local
Alibaba (Qwen) · sortie janv. 2026 · licence Apache 2.0
Ce qu'il faut retenir
La référence code de Qwen : 80 Md de paramètres dont ~3 actifs par token grâce à une architecture hybride à attention linéaire. La qualité d'un grand modèle avec le débit d'un petit, taillé pour les agents de code et les gros dépôts.
Licence et usage commercial
Apache 2.0 : usage commercial libre, sans restriction.
Sur quelle machine ?
Qwen3 Coder Next (80B) demande ≈ 50 Go de VRAM : le modèle chargé en quantisation Q4, plus la marge du cache KV, qui grandit avec la longueur des conversations et le nombre d'utilisateurs simultanés. Il faut donc 1 RTX PRO 5000 Blackwell 72 Go dans un Lenovo ThinkStation P8, soit notre configuration Standard, prévue pour jusqu'à 50 utilisateurs. Ce dimensionnement est un ordre de grandeur. Nous ne partons jamais de la machine : nous cadrons vos usages, nous en déduisons le modèle, puis la configuration qui le fait tourner, et nous validons par un test sur vos données réelles.
Popularité Hugging Face : 509 562 téléchargements le mois dernier, 1 614 likes.
Déployer Qwen3 Coder Next (80B) chez vous ?
Nous installons ce modèle sur une configuration Standard dans vos locaux, connecté à vos documents et vos outils. Audit gratuit, sans engagement.