En résumé
L’AISI constate en 2026 un écart réduit entre modèles propriétaires et modèles à poids ouverts.
GLM-5.2 se rapproche de Claude Opus 4.6 sur un ensemble de 70 évaluations.
Kimi K3 doit publier ses poids dans les prochaines semaines.
Le signal : L’AISI observe en 2026 que GLM-5.2 et DeepSeek V4-Pro se rapprochent des modèles propriétaires récents.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
L’AISI compare En 2026, l’AI Security Institute du gouvernement britannique a analysé l’écart entre modèles propriétaires et modèles à poids ouverts. L’étude porte sur leurs capacités en cybersécurité. Selon l’AISI, la différence entre les modèles propriétaires puissants et les modèles à poids ouverts s’est réduite cette année. L’institut décrit aussi un rapprochement entre une frontière contrôlable et une frontière diffusée ouvertement. Cette évolution concerne directement la comparaison des capacités, plutôt que la seule disponibilité des modèles. Les résultats placent donc les modèles ouverts dans une position plus proche des systèmes propriétaires récents. L’analyse publiée par l’AISI est accessible sur son site officiel.
Des modèles récents GLM-5.2 et DeepSeek V4-Pro obtiennent des performances similaires à celles de modèles propriétaires de pointe sortis quatre à sept mois plus tôt. L’AISI utilise cette comparaison temporelle pour mesurer le rapprochement entre les deux catégories. Sur un ensemble de 70 évaluations, GLM-5.2 est le plus proche de Claude Opus 4.6. Ce dernier avait été lancé 4,3 mois auparavant. Ces résultats situent GLM-5.2 près d’un modèle fermé de référence, dans cette série d’évaluations. DeepSeek V4-Pro apparaît également dans le groupe des modèles ouverts comparés aux systèmes propriétaires récents. L’analyse détaille ces écarts entre générations de modèles.
Kimi K3 progresse Kimi K3 est un modèle de 2,8 billions de paramètres développé par des entreprises chinoises. Le modèle affiche de solides performances sur des tâches de référence. Kimi affirme aussi que K3 a démontré des performances de niveau frontière sur l’ensemble d’évaluation. Cette affirmation est attribuée à Kimi et concerne directement les résultats revendiqués pour le modèle. Les poids de Kimi K3 doivent être rendus publics dans les prochaines semaines. Cette publication annoncée ajoutera un nouveau modèle à poids ouverts au groupe observé par les comparaisons de 2026. La présentation du modèle est disponible sur le blog de Kimi.
Hassabis propose Demis Hassabis a proposé un cadre réglementaire destiné à tester les systèmes d’IA de frontière. Sa proposition porte sur l’organisation d’évaluations appliquées à ces systèmes. Elle intervient dans le même ensemble de débats que les comparaisons entre modèles propriétaires et modèles à poids ouverts. Le cadre proposé concerne donc le test des capacités des systèmes les plus avancés. La proposition est attribuée à Demis Hassabis et ne constitue pas un résultat d’évaluation présenté par l’AISI. Son annonce peut être consultée dans sa publication. Le même sujet est également présenté dans un texte consacré à la politique liée à l’IA exponentielle.
Un écart suivi L’AISI mesure la distance entre modèles propriétaires et modèles à poids ouverts à partir de capacités de cybersécurité. En 2026, l’institut constate que cette distance s’est réduite. GLM-5.2 se rapproche de Claude Opus 4.6 sur 70 évaluations, avec un décalage de 4,3 mois entre leurs sorties. DeepSeek V4-Pro rejoint aussi les modèles propriétaires de pointe sortis quatre à sept mois avant lui. Kimi K3 ajoute un modèle chinois de 2,8 billions de paramètres à cette évolution, avec une publication des poids annoncée dans les prochaines semaines. Hassabis propose parallèlement un cadre pour tester les systèmes d’IA de frontière.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés