# GLM-5.2 et DeepSeek V4-Pro rattrapent Claude Opus 4.6

> En 2026, l’AISI constate un écart réduit entre modèles propriétaires et modèles à poids ouverts, tandis que Kimi K3 prépare la publication de ses poids.

Type : Actualité IA · Catégorie : Tendances · Publié le 2026-09-23 · Signal IA - Order & Chaos · Secteur : Cybersécurité
Source : https://www.orderchaos.eu/signal-ia/actu/glm-52-et-deepseek-v4-pro-talonnent-claude-opus-46
Tags : modèles ouverts, cybersécurité, régulation, ia chinoise, claude, deepseek, kimi, open-source

---

## En résumé

- L’AISI constate en 2026 un écart réduit entre modèles propriétaires et modèles à poids ouverts.
- GLM-5.2 se rapproche de Claude Opus 4.6 sur un ensemble de 70 évaluations.
- Kimi K3 doit publier ses poids dans les prochaines semaines.

**Le signal :** L’AISI observe en 2026 que GLM-5.2 et DeepSeek V4-Pro se rapprochent des modèles propriétaires récents.

**L’AISI compare** En 2026, l’AI Security Institute du gouvernement britannique a analysé l’écart entre modèles propriétaires et modèles à poids ouverts. L’étude porte sur leurs capacités en cybersécurité. Selon l’AISI, la différence entre les modèles propriétaires puissants et les modèles à poids ouverts s’est réduite cette année. L’institut décrit aussi un rapprochement entre une frontière contrôlable et une frontière diffusée ouvertement. Cette évolution concerne directement la comparaison des capacités, plutôt que la seule disponibilité des modèles. Les résultats placent donc les [modèles ouverts](/signal-ia/actu/aisi-et-kimi-k3-rebattent-les-cartes-de-lia-ouverte) dans une position plus proche des systèmes propriétaires récents. L’analyse publiée par l’AISI est accessible [sur son site officiel](https://www.aisi.gov.uk/blog/how-far-behind-the-frontier-are-leading-open-weight-models-on-cyber). 

**Des modèles récents** GLM-5.2 et DeepSeek V4-Pro obtiennent des performances similaires à celles de modèles propriétaires de pointe sortis quatre à sept mois plus tôt. L’AISI utilise cette comparaison temporelle pour mesurer le rapprochement entre les deux catégories. Sur un ensemble de 70 [évaluations](/signal-ia/actu/laisi-voit-lecart-se-reduire-kimi-k3-atteint-la-frontiere), GLM-5.2 est le plus proche de Claude Opus 4.6. Ce dernier avait été lancé 4,3 mois auparavant. Ces résultats situent GLM-5.2 près d’un modèle fermé de référence, dans cette série d’évaluations. DeepSeek V4-Pro apparaît également dans le groupe des modèles ouverts comparés aux systèmes propriétaires récents. L’analyse détaille ces écarts entre générations de modèles.

## GLM-5.2 se rapproche de Claude

**Kimi K3 progresse** Kimi K3 est un modèle de 2,8 billions de paramètres développé par des entreprises chinoises. Le modèle affiche de solides performances sur des tâches de référence. Kimi affirme aussi que K3 a démontré des performances de niveau frontière sur l’ensemble d’évaluation. Cette affirmation est attribuée à Kimi et concerne directement les résultats revendiqués pour le modèle. Les poids de Kimi K3 doivent être rendus publics dans les prochaines semaines. Cette publication annoncée ajoutera un nouveau modèle à poids ouverts au groupe observé par les comparaisons de 2026. La présentation du modèle est disponible [sur le blog de Kimi](https://www.kimi.com/blog/kimi-k3).

**Hassabis propose** Demis Hassabis a proposé un cadre réglementaire destiné à tester les systèmes d’IA de frontière. Sa proposition porte sur l’organisation d’évaluations appliquées à ces systèmes. Elle intervient dans le même ensemble de débats que les comparaisons entre modèles propriétaires et modèles à poids ouverts. Le cadre proposé concerne donc le test des capacités des systèmes les plus avancés. La proposition est attribuée à Demis Hassabis et ne constitue pas un résultat d’évaluation présenté par l’AISI. Son annonce peut être consultée [dans sa publication](https://x.com/demishassabis/status/2076957440109625718). Le même sujet est également présenté dans un texte consacré à la politique liée à l’IA exponentielle.

## Hassabis propose un cadre de test

**Un écart suivi** L’AISI mesure la distance entre modèles propriétaires et modèles à poids ouverts à partir de capacités de [cybersécurité](/signal-ia/actu/glm-52-reduit-lecart-cyber-avec-claude-opus-a-43-mois). En 2026, l’institut constate que cette distance s’est réduite. GLM-5.2 se rapproche de Claude Opus 4.6 sur 70 évaluations, avec un décalage de 4,3 mois entre leurs sorties. DeepSeek V4-Pro rejoint aussi les modèles propriétaires de pointe sortis quatre à sept mois avant lui. Kimi K3 ajoute un modèle chinois de 2,8 billions de paramètres à cette évolution, avec une publication des poids annoncée dans les prochaines semaines. Hassabis propose parallèlement un cadre pour tester les systèmes d’IA de frontière.
