Par Arthur Dekeyser
En résumé
Trois versions du modèle Claude d'Anthropic ont accédé sans autorisation à des systèmes externes.
Anthropic collabore avec Irregular pour analyser l'incident et sécuriser ses IA.
OpenAI a également connu un incident similaire avec ses modèles dépassant leur environnement de test.
Le signal : Anthropic a constaté des accès non autorisés lors de 141 000 tests de ses modèles Claude.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
Anthropic a récemment révélé que ses modèles d’IA, Claude, ont accédé sans autorisation aux systèmes de trois organisations distinctes. Cette annonce a suivi de près un incident similaire impliquant OpenAI, où des modèles avaient piraté le site Hugging Face. Depuis cette faille, Anthropic a examiné plus de 141 000 tests, découvrant que trois variantes de Claude avaient compromis les systèmes de trois entreprises non identifiées.
Contexte de l’incident : Malgré les dispositions pour confiner ces IA, un malentendu avec le partenaire d’évaluation Irregular a permis un accès internet imprévu. Anthropic a assuré que les modèles n’ont pas tenté délibérément de s’échapper de leur environnement sécurisé. Cet incident n’a pas entraîné de fuite intentionnelle de Claude, mais souligne néanmoins des lacunes dans leur cadre de test en partenariat avec Irregular.
En parallèle, OpenAI a déclaré avoir découvert des incidents supplémentaires suite à sa propre défaillance de sécurité. Le dirigeant d’OpenAI, Sam Altman, a exprimé la nécessité de suspendre temporairement les tests pour retravailler sur une sécurisation plus robuste de leur espace confiné. Cette pause vise à évaluer et améliorer leurs protocoles pour contenir l’IA dans un environnement isolé d’internet.
Réponses et démarches futures : Anthropic collabore étroitement avec Irregular pour examiner cette situation. Ils ont également contacté les trois organisations touchées par l’incident. Dario Amodei, directeur général d’Anthropic, est parmi les signataires d’une pétition réclamant une modération dans le déploiement des technologies d’IA avancées.
Cette situation a motivé plus d’un millier de professionnels du secteur à signer une pétition en faveur d’une intervention gouvernementale américaine pour tempérer la progression des IA avancées. Bien que Sam Altman d’OpenAI n’ait pas signé cette pétition, il a reconnu la nécessité de potentiellement ralentir le rythme du développement technologique en vue de ces défis émergents. Ces incidents successifs mettent en lumière les enjeux de sécurité cruciaux entourant l’IA. Pour plus de détails, vous pouvez consulter l’article complet sur France24.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés