Comparatif LLM

Ornith 1.0 35B (MoE) en déploiement local

DeepReinforce · sortie juin 2026 · licence MIT

Code Raisonnement Vision Config Micro
Taille 35 Md MoE : 3 Md actifs par token
VRAM estimée ≈ 27 Go modèle en Q4 + cache KV
Contexte 256k tokens
Français ●●○ Bon

Ce qu'il faut retenir

Un MoE de 35 Md dont 3 actifs par token, entraîné à produire lui-même son échafaudage d'agent, sous licence MIT. À sa sortie il devançait nettement les généralistes de sa taille sur les tests d'agents de développement : 64,2 sur Terminal-Bench 2.1 contre 52,5 pour Qwen3.6 35B et 42,1 pour Gemma 4 31B. Une alternative spécialisée, sur une seule carte.

Licence et usage commercial

MIT : usage commercial libre, sans restriction.

Sur quelle machine ?

Ornith 1.0 35B (MoE) demande ≈ 27 Go de VRAM : le modèle chargé en quantisation Q4, plus la marge du cache KV, qui grandit avec la longueur des conversations et le nombre d'utilisateurs simultanés. Il faut donc 1 RTX PRO 5000 Blackwell 48 Go dans un Lenovo ThinkStation P3, soit notre configuration Micro, prévue pour jusqu'à 10 utilisateurs. Ce dimensionnement est un ordre de grandeur. Nous ne partons jamais de la machine : nous cadrons vos usages, nous en déduisons le modèle, puis la configuration qui le fait tourner, et nous validons par un test sur vos données réelles.

Popularité Hugging Face : 3 188 828 téléchargements le mois dernier, 505 likes.

Déployer Ornith 1.0 35B (MoE) chez vous ?

Nous installons ce modèle sur une configuration Micro dans vos locaux, connecté à vos documents et vos outils. Audit gratuit, sans engagement.

Demander un audit gratuit