Anthropic choisit Accenture comme premier évaluateur embarqué
Anthropic nomme Accenture, via sa filiale Faculty, premier évaluateur embarqué, au moins un milliard de dollars chacun sur cinq ans, là où l'on attendait METR.

Le premier évaluateur de sûreté embarqué d'Anthropic porte un nom que personne n'attendait : Accenture. Vendredi 18 septembre, le laboratoire a annoncé que des employés du géant du conseil, via sa filiale Faculty, travailleront à l'intérieur de l'entreprise pour examiner ses modèles et ses pratiques, avec un accès comparable à celui d'un salarié. Vendredi soir, l'action Accenture bondissait d'environ 8 % après la clôture, selon TechCrunch.
La décision tranche avec le débat des jours précédents. Depuis l'essai de Dario Amodei du samedi 12 septembre, dont les évaluateurs embarqués sont la première étape (notre article sur l'accord « pacing »), la discussion publique tournait autour des labos de recherche en sûreté : METR, Redwood Research, Apollo Research. Jeudi encore, notre article sur l'indépendance des évaluateurs concluait : rien n'est signé. Le 18 septembre, un contrat est annoncé, et c'est un cabinet de conseil d'environ 799 000 salariés qui entre chez Anthropic.
Ce qu'Anthropic a annoncé, exactement
Le billet liste trois missions pour l'équipe d'Accenture : évaluer les modèles et les soumettre à des tests d'attaque (red-teaming), mener des évaluations d'alignement, et tester les dispositifs de protection des modèles. Ces évaluateurs pourront observer les modèles pendant l'entraînement, suivre les décisions qui gouvernent leur construction et leur déploiement, parler directement aux salariés, signaler des incidents et donner au public « un compte plus informé des avantages et des risques ».
Le partenariat est non exclusif : Anthropic annonce d'autres évaluateurs « dans les semaines qui viennent », et Accenture travaillera aussi pour d'autres développeurs d'IA. Anthropic dit être en discussion avec METR et d'autres organisations à but non lucratif pour piloter des éléments d'évaluation embarquée sur leurs fonds propres. Le billet reconnaît surtout qu'il n'existe pas encore de normes sur l'information à laquelle les évaluateurs devraient accéder ni sur la manière de restituer ce qu'ils trouvent, et qu'aucun système de financement pérenne n'est établi.
Les évaluateurs embarqués indépendants ne réduisent pas notre responsabilité, ils aident à la rendre plus vérifiable. La sécurité de nos modèles reste notre responsabilité.Anthropic, billet du 18 septembre 2026 · traduit de l'anglais

Nous nous associons à Accenture pour l'évaluation indépendante de l'IA de pointe, dans le prolongement de notre engagement récent d'accueillir des évaluateurs embarqués chez Anthropic. Anthropic comme Accenture prévoient d'investir au moins un milliard de dollars pour construire des capacités dans ce domaine au cours des cinq prochaines années.Voir le post sur X
Pourquoi un cabinet de conseil plutôt que METR
« Le choix d'Accenture a surpris beaucoup d'observateurs de l'IA », écrit Tim Fernholz dans TechCrunch, qui note que le débat né de l'essai d'Amodei se concentrait précisément sur les organisations de recherche en sûreté comme METR, Redwood Research ou Apollo Research. Anthropic avance deux arguments. D'abord l'expérience de terrain : Accenture aide entreprises et gouvernements à déployer l'IA dans de nombreuses industries, et cette connaissance des usages réels informerait son approche de la sûreté. Ensuite l'indépendance fonctionnelle : grand groupe coté antérieur à la révolution de l'IA, il serait, selon TechCrunch, plus indépendant d'Anthropic et de son écosystème qu'un acteur du monde de la recherche en sûreté.
Faculty, la filiale qui pilote le partenariat, a été rachetée en janvier par Accenture pour devenir sa division IA (selon TechCrunch). Son communiqué la présente comme « une experte reconnue pour tester et évaluer les modèles de certains des principaux labos IA », avec des travaux pour des gouvernements, la défense et la santé, dont le système d'alerte précoce du service de santé britannique pendant la pandémie de covid.
La sécurité exige à la fois une expertise technique profonde et une compréhension claire de la manière dont l'IA est utilisée dans le monde réel.Julie Sweet, PDG d'Accenture, communiqué du 18 septembre · traduit de l'anglais
Les premiers retours du milieu de la recherche ne suivent pas. Leo Gao, cofondateur du collectif EleutherAI, répond au post d'annonce d'Anthropic en une phrase.
METR est infiniment plus qualifiée qu'Accenture pour être un auditeur embarqué.Voir le post sur X
Le mot « indépendance », déjà discuté sous le post d'annonce
Le post X de l'annonce porte une note de communauté dont le texte interroge la formulation d'Anthropic : « Anthropic présente cela comme une "évaluation indépendante", mais va financer directement le travail d'Accenture et entretient un partenariat commercial antérieur de déploiement de ses modèles, incluant la formation d'environ 30 000 professionnels d'Accenture sur Claude » (texte relevé via l'API publique de syndication de X, la note renvoyant elle-même vers deux billets du blog d'Anthropic). Les faits qu'elle rappelle sont vérifiables dans les sources mêmes de l'annonce : le billet dit bien qu'« Anthropic financera directement le travail d'Accenture », et le partenariat commercial antérieur entre les deux entreprises pour le déploiement des modèles d'Anthropic est affiché sur le site d'Accenture. Le chiffre de 30 000 professionnels formés vient de la note.
Ce paradoxe du financement est au cœur des réserves. Le billet d'Anthropic affirme qu'à terme le financement de l'évaluation indépendante devrait venir de sources mutualisées ou publiques ; en attendant, l'entreprise paie son évaluateur, et les organisations à but non lucratif comme METR sont invitées à piloter sur leurs propres fonds. Selon TechCrunch, des critiques partisans d'une approche plus responsable de la construction de l'IA voient dans ce système d'autorégulation un « plan pour échapper à la redevabilité » des comportements des modèles. Le journaliste rappelle aussi pourquoi la tension monte : des agents IA déployés par OpenAI et Anthropic ont piraté des sites externes sans déclencher d'alerte interne, une série que nous documentons dans notre enquête sur les piratages commis par les agents.
Anthropic reconnaît elle-même l'absence de tout standard et finance directement le travail d'Accenture. La valeur du dispositif dépendra donc de ce que les prochains évaluateurs, notamment les ONG sur fonds propres, seront capables de publier, et de l'obligation légale qui pourrait leur donner les moyens d'exiger, comme le laissent entrevoir la loi californienne SB 813 et l'AI Act européen.
Ce que l'annonce précise, et ce qu'elle laisse ouvert
| La question posée depuis samedi 12 | Ce que le 18 septembre précise | Ce qui reste ouvert |
|---|---|---|
| Qui évaluera les modèles ? | Accenture via Faculty, d'autres noms « dans les semaines qui viennent » | L'identité des prochains évaluateurs, dont METR n'est qu'une discussion |
| Avec quel accès ? | Comparable à celui d'un salarié, pendant l'entraînement | Aucune norme ne fixe le périmètre d'information accessible |
| Qui paie ? | Anthropic finance directement Accenture, les ONG piloteraient sur fonds propres | Le financement mutualisé ou public, encore à construire |
| Que sera publié ? | Signalement d'incidents, « un compte plus informé » pour le public | Les modalités de restitution des conclusions |
La suite est annoncée pour bientôt : d'autres évaluateurs dans les semaines qui viennent, et un dispositif qu'Anthropic dit prêt à faire évoluer. La vraie question, posée depuis l'essai d'Amodei, reste entière : un évaluateur choisi et payé par le laboratoire peut-il contrarier ce laboratoire ? La réponse d'Accenture, premier évaluateur embarqué nommé, servira de test à tous les autres.
Questions fréquentes
Qu'est-ce qu'un évaluateur embarqué ?
Un organisme externe installé à l'intérieur d'un laboratoire IA, avec un accès comparable à celui d'un salarié, capable d'observer les modèles pendant l'entraînement et de vérifier les engagements de sécurité. Notre article du 17 septembre détaille ce que les chercheurs demandent.
Qui est le premier évaluateur embarqué d'Anthropic ?
Accenture, via sa filiale Faculty, rachetée en janvier 2026 selon TechCrunch. L'annonce date du vendredi 18 septembre 2026.
Combien Anthropic et Accenture investissent-ils ?
Chacune s'attend à investir au moins un milliard de dollars sur cinq ans, soit au moins deux milliards au total, chiffre confirmé par le billet d'Anthropic et le communiqué d'Accenture.
Pourquoi Accenture plutôt que METR ?
Anthropic invoque l'expérience d'Accenture dans le déploiement de l'IA en entreprise et son indépendance fonctionnelle de grand groupe coté. METR et d'autres ONG sont en discussions pour des pilotes sur leurs fonds propres, et d'autres évaluateurs seront annoncés.
Ce dispositif garantit-il des évaluations indépendantes ?
C'est le point contesté : une note de communauté sous le post d'annonce et des chercheurs comme Leo Gao questionnent le choix et le financement. Anthropic répond que ces évaluateurs ne réduisent pas sa responsabilité mais aident à la rendre plus vérifiable.


