Par Arthur Dekeyser
En résumé
Anthropic accueillera des équipes d’Accenture pour évaluer et tester ses modèles.
Faculty mènera des évaluations d’alignement et des tests de protections.
Les deux entreprises prévoient d’investir au moins 1 milliard de dollars sur cinq ans.
Le signal : Anthropic et Accenture prévoient d’investir au moins 1 milliard de dollars dans l’évaluation des modèles sur cinq ans.
Vous appréciez ce genre d'analyse ?
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.
+11 000 fondateurs abonnés
Anthropic intègre Accenture pour examiner ses modèles et ses équipes. Le laboratoire a annoncé que des salariés du groupe de conseil commenceront à travailler en interne. Faculty, entreprise acquise par Accenture en janvier pour devenir sa division consacrée à l’IA, conduira cette mission. Les équipes évalueront les modèles, mèneront des tests offensifs et réaliseront des évaluations d’alignement. Elles testeront aussi les protections intégrées aux systèmes. Anthropic et Accenture prévoient d’investir au moins 1 milliard de dollars dans ce projet au cours des cinq prochaines années. L’annonce intervient après la proposition de Dario Amodei d’intégrer des évaluateurs indépendants dans les laboratoires d’IA. Lire l’annonce d’Anthropic.
Le choix d’Accenture surprend plusieurs observateurs du secteur. Les discussions suscitées par la proposition de Dario Amodei citaient surtout METR, Redwood Research et Apollo Research. Ces organisations sont connues pour leurs travaux spécialisés sur l’évaluation de la sûreté des modèles. Accenture apporte une expérience différente, liée au déploiement de systèmes d’IA auprès de grandes entreprises et d’agences gouvernementales. Anthropic présente cette expérience pratique comme un avantage pour examiner des usages opérationnels. Le groupe de conseil est aussi une grande entreprise cotée, créée avant l’essor actuel de l’IA. Anthropic considère cette caractéristique comme un facteur d’indépendance fonctionnelle vis-à-vis du laboratoire et de son écosystème.
Les missions couvrent plusieurs contrôles techniques et comportementaux. Faculty évaluera les modèles, conduira des tests offensifs et réalisera des évaluations d’alignement. Ses équipes examineront également les protections prévues par Anthropic. Cette organisation place des intervenants extérieurs au cœur du processus d’examen. Les évaluations externes participent déjà aux procédures de sortie des grands modèles de langage. Anthropic souhaite donc élargir ce dispositif avec des équipes intégrées au laboratoire. L’entreprise indique que ces évaluateurs ne diminuent pas sa responsabilité. Elle affirme au contraire qu’ils doivent rendre cette responsabilité plus vérifiable. La sûreté des modèles reste, selon Anthropic, sous la responsabilité du laboratoire.
Le dispositif reste évolutif car aucun standard ne définit encore l’accès des évaluateurs ou leurs communications. Anthropic indique que son approche évoluera au fil de sa mise en œuvre. Le laboratoire prévoit d’annoncer d’autres évaluateurs dans les prochaines semaines. Il discute aussi avec METR et d’autres organisations à but non lucratif. Ces échanges portent sur un projet pilote utilisant leur propre financement. Anthropic a donc prévu plusieurs formats de participation, avec Accenture comme premier partenaire intégré annoncé. Les incidents récents ont renforcé l’attention portée à ces contrôles. Des agents d’OpenAI et d’Anthropic ont piraté des sites externes sans déclencher d’alerte dans les laboratoires.
Le débat porte aussi sur la responsabilité des laboratoires qui évaluent eux-mêmes leurs modèles. Certains critiques estiment que le dispositif proposé par Dario Amodei pourrait permettre à l’industrie de s’autoréguler. Ils y voient un risque d’évitement de la responsabilité après des comportements indésirables des modèles. Anthropic défend une position différente. Le laboratoire affirme que des évaluateurs extérieurs ne réduisent pas sa responsabilité, mais rendent son exercice plus vérifiable. L’arrivée de Faculty matérialise cette approche avec des équipes issues d’Accenture. Les prochaines annonces d’évaluateurs et les discussions avec METR préciseront le fonctionnement du dispositif, tandis que les standards d’accès et de communication restent à établir. Consulter l’article de TechCrunch.
Gardez un coup d'avance en IA et tech.
Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.
+11 000 fondateurs abonnés