# METR dévoile failles chez Anthropic : sécurité à revoir

> L'exercice de red-teaming mené par METR chez Anthropic a révélé plusieurs vulnérabilités dans ses systèmes de surveillance des agents.

Type : Actualité IA · Catégorie : Stratégie · Publié le 2026-08-16 · Signal IA - Order & Chaos · Secteur : Cybersécurité
Source : https://www.orderchaos.eu/signal-ia/actu/metr-devoile-failles-chez-anthropic-securite-a-revoir
Tags : cybersécurité, vulnérabilités, ia, claude

---

## En résumé

- METR a collaboré avec Anthropic pour tester la sécurité de ses systèmes internes.
- L'exercice a duré trois semaines et a révélé plusieurs vulnérabilités.
- Des améliorations aux systèmes de surveillance d'Anthropic sont prévues grâce à ces découvertes.

**Le signal :** David Rein de METR a mené une analyse de sécurité chez Anthropic durant trois semaines.

**David Rein de METR** a récemment passé trois semaines à analyser les systèmes de surveillance des agents internes chez Anthropic grâce à une méthode de red-teaming. Ce processus a permis de découvrir plusieurs vulnérabilités spécifiques, qui ont été partagées dans un rapport de 26 pages avec Anthropic. Ces découvertes, même si elles n'affaiblissent pas les principales affirmations du rapport de risque Opus 4.6 d'Anthropic, pointent vers des axes d'amélioration potentiels. [Source originale](https://metr.org/blog/2026-03-25-red-teaming-anthropic-agent-monitoring/).

**Anthropic a fait preuve** de transparence en offrant à METR un accès substantiel à ses systèmes internes et en rendant son personnel disponible pour répondre aux questions. L'objectif était de non seulement identifier les vulnérabilités mais aussi de développer des pratiques exemplaires pour intégrer des évaluateurs tiers. L'exercice a produit des artefacts utiles, tels que des trajectoires d'agent comportant des attaques furtives, qui serviront à l'amélioration continue des systèmes de surveillance de l'entreprise.

## Des exercices de ce type

**Des exercices de ce type** devraient se répéter pour continuer à renforcer la sécurité des systèmes IA. METR espère voir plus de collaborations similaires avec d'autres développeurs d'IA à l'avenir. Cette démarche proactive d'Anthropic et METR est essentielle à l'heure où les systèmes IA évoluent et où les menaces potentielles augmentent. Pour plus de détails, consultez le rapport [Opus 4.6 Sabotage Risk Report](https://anthropic.com/claude-opus-4-6-risk-report) mentionné dans la présentation de l'exercice.

**Les prochaines étapes** visent à intégrer les leçons tirées de ces exercices dans les futurs rapports de risque de METR. De telles collaborations renforcent la sécurité globale des systèmes d'IA et établissent des standards de sécurité élevés dans l'industrie.
