# Decodo place Claude et Nova Act en tête des agents IA

> Decodo a testé 45 agents IA sur dix capacités et constate que les actions transactionnelles obtiennent la note moyenne la plus basse, à 0,43 sur 2.

Type : Actualité IA · Catégorie : Outils · Publié le 2026-09-04 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/decodo-revele-le-talon-dachille-des-agents-ia
Tags : agents ia, automatisation, sécurité, évaluation, claude, chatgpt, agents-ia

---

## En résumé

- Decodo a évalué 45 agents IA sur dix capacités différentes.
- Claude for Chrome et Amazon Nova Act ont obtenu 18 points sur 20.
- Les actions transactionnelles affichent la moyenne la plus faible, avec 0,43 point sur 2.

**Le signal :** Decodo a évalué 45 agents IA et relevé une moyenne de 0,43 sur 2 pour les actions transactionnelles.

**Test étendu** Le 4 septembre 2026, Decodo a publié une analyse de 45 agents IA évalués sur dix capacités. L’étude compare leurs comportements dans plusieurs fonctions liées à l’utilisation d’outils numériques. Claude for Chrome et Amazon Nova Act arrivent ex aequo en tête, avec 18 points sur 20. Fellou et ChatGPT Desktop suivent avec 17 points. Le classement porte donc sur un total de 20 points. Decodo distingue notamment les actions transactionnelles, la capacité à fonctionner sans session utilisateur active et la compréhension des tableaux croisés. Ces résultats placent la fiabilité opérationnelle au centre de l’évaluation. Ils mesurent des capacités précises, plutôt qu’une simple longueur de liste fonctionnelle. [Lire l’analyse de Decodo](https://aiproptechnews.com/article/decodo-analyses-where-ai-agents-are-falling-short/).

**Failles transactionnelles** Les actions transactionnelles obtiennent la moyenne la plus basse, avec 0,43 point sur 2. Seuls six outils atteignent la note maximale dans cette catégorie. Decodo indique aussi que 51 % des agents ne documentent aucune étape de confirmation avant une action irréversible. Cette absence concerne donc plus d’un agent sur deux dans l’échantillon étudié. Le résultat porte sur la documentation d’une confirmation, et non sur l’issue de chaque action. Il souligne toutefois une différence entre exécuter une tâche et encadrer une opération irréversible. Les outils évalués incluent notamment Airtop, Axiom AI et BrowserOS. Leur présence dans l’analyse ne signifie pas qu’ils obtiennent le même résultat sur chaque capacité.

## Decodo mesure les actions critiques

**Classement des outils** Claude for Chrome et Amazon Nova Act partagent la première place avec 18 points sur 20. Fellou et ChatGPT Desktop atteignent chacun 17 points. Ces scores regroupent les dix capacités évaluées par Decodo. Ils ne correspondent donc pas uniquement aux actions transactionnelles. La moyenne de 0,43 sur 2 dans cette catégorie contraste avec les scores globaux des premiers outils. Cette différence montre que la performance générale peut coexister avec une note faible sur une capacité particulière. Decodo a aussi relevé 17 outils capables de fonctionner sans session utilisateur active. Cette possibilité constitue une caractéristique mesurée dans l’analyse, distincte du classement final. [Consulter les résultats présentés par Decodo](https://aiproptechnews.com/article/decodo-analyses-where-ai-agents-are-falling-short/).

**Compréhension des données** La capacité de compréhension des tableaux croisés obtient 0,66 point sur 2. Decodo l’évalue parmi les dix capacités de son étude. Cette note reste supérieure à celle des actions transactionnelles, qui atteint 0,43 sur 2. Les deux scores restent exprimés sur la même échelle de deux points. L’écart entre ces résultats permet de distinguer plusieurs types de limites. Un agent peut donc obtenir un classement global élevé tout en rencontrant des difficultés sur une compétence donnée. L’analyse associe ces mesures à des outils nommés, comme Claude for Chrome, Amazon Nova Act, Fellou et ChatGPT Desktop. Elle inclut également Airtop, Axiom AI et BrowserOS.

## Les confirmations restent inégales

**Responsabilité opérationnelle** Gabriele Vitke recommande d’associer l’outil à la tâche, plutôt qu’à la liste de fonctionnalités la plus longue. Elle ajoute qu’une personne de l’équipe devra rester responsable lorsque l’agent se trompe. Cette recommandation accompagne les résultats de Decodo sur les actions irréversibles. Dans cette catégorie, 51 % des agents ne documentent aucune confirmation préalable. Six outils seulement obtiennent la note maximale sur deux. La responsabilité évoquée par Vitke ne constitue pas un score de l’évaluation. Elle formule une règle d’usage attribuée à son autrice. Les résultats disponibles permettent ainsi de relier le choix d’un agent à une capacité précise, sans réduire la sélection au classement global.
Pour aller plus loin, consultez notre guide sur [déployer un agent IA en PME sans développeur](/signal-ia/guides/agents-ia-pme-sans-developpeur-2026).
