En résumé
Zyphra, Cohere et Poolside publient plusieurs modèles ouverts.
Cohere place Command A+ sous licence Apache 2.0.
NVIDIA adopte OpenMDW pour les poids de ses modèles.
Le signal : Cohere publie Command A+ sous Apache 2.0, avec 218 milliards de paramètres et une architecture MoE activable sur un seul B200 en 4 bits.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
Écosystème élargi Le 28 juin 2026, Florian Brand et Nathan Lambert observent une diversification des publications de modèles ouverts. Ils citent Zyphra, Cohere et Poolside parmi les acteurs qui élargissent cet écosystème. Selon leur analyse, le paysage était dominé par quelques acteurs chinois un an plus tôt. Les publications récentes incluent désormais davantage d’entreprises spécialisées, réparties dans plusieurs régions. Les auteurs distinguent trois familles d’acteurs. Les fabricants de modèles visent la frontière ouverte ou une position proche. Les grandes entreprises technologiques poursuivent des motivations différentes. Les entreprises de produits entraînent plutôt des modèles spécialisés adaptés à leurs usages. Lire l’analyse complète.
Trois familles d’acteurs Les fabricants de modèles comprennent DeepSeek, Zhipu, Minimax, Poolside, Arcee et Zyphra. Cohere, Sovereign, Mistral et Trillion Labs sont également cités parmi les acteurs de l’IA souveraine. Alibaba utilise ses publications pour soutenir ses modèles fermés, selon l’analyse. NVIDIA bénéficie pour sa part d’un écosystème ouvert qui accroît l’intérêt pour ses processeurs graphiques. JetBrains, Zed, Krea et Photoroom développent des modèles plus petits et spécialisés. Ces entreprises les intègrent à leurs produits. La publication des poids peut répondre à leurs besoins sans nuire à leur activité commerciale, d’après les auteurs. Cette diversité soutient l’hypothèse d’un nombre croissant de modèles de niche.
Licences plus ouvertes NVIDIA présente Nemotron-3-Ultra-550B-A55B-BF16 comme la grande version de sa série Nemotron. Le modèle utilise LatentMoE pour viser une vitesse supérieure à celle de modèles comparables. La majorité de ses données est ouverte, selon l’analyse publiée. NVIDIA s’engage aussi à utiliser la licence OpenMDW, conçue pour les poids et les données des modèles. L’entreprise abandonne ainsi sa licence personnalisée pour cette famille de publications. Cohere Labs publie Command A+ sous Apache 2.0. Les versions précédentes de cette série utilisaient une licence non commerciale. Command A+ combine des capacités multimodales, multilingues et agentiques. Son architecture 218B-A25B MoE peut fonctionner sur un seul B200 en précision 4 bits. Voir Nemotron-3-Ultra sur Hugging Face.
Nouveaux modèles spécialisés Zai-org publie GLM-5.2, présenté comme utilisable pour le travail quotidien. Les auteurs indiquent que ses performances régressent peu face aux meilleurs modèles fermés disponibles au moment de leur analyse. Ses téléchargements bruts suivent toutefois une trajectoire proche de celle de GLM-5 après sa sortie. Zyphra publie ZAYA1-74B-preview, un modèle MoE de 74B-A4B. L’entreprise est connue pour entraîner ses modèles sur des processeurs AMD et pour ses choix d’architecture détaillés dans ses rapports techniques. Elle propose aussi un MoE 8B-A0.6B. Poolside publie Laguna-M.1 sous Apache 2.0. L’entreprise affirme que les poids ouverts deviennent sa règle par défaut et annonce des publications ouvertes plus performantes.
Un modèle plus diversifié Les autres publications citées renforcent la variété des usages. Moonshot met à jour Kimi-K2.7-Code avec un accent sur l’efficacité des jetons. StepFun publie Step-3.7-Flash, présenté comme particulièrement solide en mathématiques. NVIDIA propose Nemotron-Labs-Diffusion-14B, un modèle expérimental utilisable selon trois modes. Il combine génération autorégressive, diffusion et auto-spéculation. Chaque mode correspond à un usage différent, d’après l’analyse. Les rapports techniques réemploient des méthodes d’entraînement, des choix d’architecture et des données issus d’autres publications ouvertes. Les auteurs considèrent cette circulation comme une force de l’écosystème. Ils estiment également que davantage d’entreprises pourraient développer une longue traîne de modèles, tandis que moins d’acteurs viseraient la frontière ouverte absolue. Découvrir les modèles NVIDIA.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés