RED TEAMING

Red Teaming

⚖️ ETHIQUE & SECU INTERMEDIAIRE +20 XP

Definition

Le red teaming IA consiste à tenter délibérément de faire échouer, biaiser ou contourner un modèle IA pour identifier ses vulnérabilités avant déploiement. C'est une pratique de sécurité proactive adoptée par tous les grands labs d'IA.

Exemple concret

Avant le lancement de GPT-4, OpenAI a mobilisé plus de 300 testeurs externes pour tenter de faire générer au modèle des contenus dangereux et identifier les failles à corriger avant la mise en production.

Questions frequentes

Qu'est-ce que le red teaming IA ? +

Le red teaming IA consiste à tenter délibérément de faire échouer, biaiser ou contourner un modèle IA pour identifier ses vulnérabilités avant déploiement. C'est une pratique de sécurité proactive adoptée par tous les grands labs d'IA.

Comment fonctionne le red teaming IA en pratique ? +

Avant le lancement de GPT-4, OpenAI a mobilisé plus de 300 testeurs externes pour tenter de faire générer au modèle des contenus dangereux et identifier les failles à corriger avant la mise en production.

Quelle est la différence entre le red teaming IA et les guardrails ? +

Red teaming et Guardrails sont deux concepts liés mais distincts dans l'écosystème IA. Pour approfondir : Guardrails, Alignement IA, Jailbreak, Sûreté de l'IA.

NEWSLETTER BUSINESS & IA

Gardez un coup d'avance en business et IA

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés