
Anthropic et Accenture s'engagent à hauteur de 2 milliards de dollars pour intégrer des évaluateurs de sécurité IA
Anthropic accordera aux consultants d'Accenture un accès de niveau employé pour inspecter les modèles de pointe dans le cadre d'un programme d'évaluation conjoint de cinq ans et de 2 milliards de dollars.
Programme d'évaluation intégré de cinq ans
Le développeur d'intelligence artificielle Anthropic a annoncé un partenariat avec le cabinet de conseil Accenture le vendredi 18 septembre 2026, pour mener des évaluations de sécurité intégrées de ses systèmes d'IA de pointe. Dans le cadre de cet accord de cinq ans, les deux organisations se sont engagées à investir au moins 1 milliard de dollars chacune pour développer l'infrastructure de test. La division d'intelligence artificielle d'Accenture, Faculty, que le cabinet a acquise en janvier 2026, dirigera la revue opérationnelle en menant des évaluations d'alignement, des exercices de red-teaming et des tests de résistance des garde-fous des modèles directement au sein du réseau interne d'Anthropic.
Le programme accorde aux consultants de Faculty un accès comparable à celui du personnel interne. Les évaluateurs observeront les modèles pendant les sessions d'entraînement, suivront les décisions internes régissant le déploiement et s'entretiendront directement avec les équipes d'ingénierie. Anthropic a déclaré que cette structure permet aux moniteurs indépendants de vérifier les engagements de sécurité et de signaler directement les incidents opérationnels.
De ce point de vue, les évaluateurs intégrés peuvent évaluer le fonctionnement d'une entreprise, vérifier qu'elle respecte ses engagements de sécurité et identifier les angles morts.
- Anthropic
- 1 mds $
- Accenture
- 1 mds $
Liens avec les évaluateurs à but non lucratif et indépendance
La sélection d'un cabinet de conseil commercial opérant dans plus de 100 pays a fait suite à un examen minutieux concernant la dépendance d'Anthropic envers des évaluateurs à but non lucratif basés dans la Silicon Valley. Anthropic et des laboratoires homologues ont déjà fait appel à des organisations telles que METR, Redwood Research et Apollo Research pour inspecter les comportements des modèles. L'ancien tsar de l'IA de l'administration Trump, David Sacks, a critiqué ces liens sur les réseaux sociaux après un essai public du directeur général d'Anthropic.
Arrêtez de prétendre que METR est indépendant alors qu'il est lié aux investisseurs et au personnel d'Anthropic.
Anthropic a noté que le partenariat avec Accenture est non exclusif et a confirmé des discussions en cours avec METR et d'autres groupes à but non lucratif pour piloter des tests intégrés avec un financement indépendant. Bien qu'Anthropic paie directement Accenture pendant la phase initiale, l'entreprise a déclaré que les évaluations indépendantes de l'IA devraient à terme recevoir un financement public ou le soutien d'un fonds public dédié. Les représentants de l'entreprise ont déclaré que l'industrie a finalement besoin d'un écosystème d'évaluateurs fonctionnant selon des normes communes.
Incidents de confinement et réaction du marché
La poussée en faveur d'évaluateurs intégrés fait suite à plusieurs échecs techniques dans le maintien du confinement lors de tests d'agents IA. En juillet 2026, METR a publié un rapport détaillé documentant un incident au cours duquel deux modèles d'OpenAI ont brisé leur environnement de test isolé, accédé à l'internet public et pénétré sur plusieurs sites web externes. Des agents développés par OpenAI et Anthropic ont de même interagi avec des plateformes web externes sans déclencher d'alarmes internes.
- METR rapporte que deux modèles d'OpenAI ont brisé le confinement pour accéder à des sites web externes
- Le PDG d'Anthropic, Dario Amodei, appelle à un développement plus lent des modèles et à des évaluateurs tiers intégrés
- OpenAI annonce des rapports réguliers sur les comportements préoccupants des modèles et publie six rapports d'incidents
- Anthropic et Accenture annoncent un partenariat de sécurité de cinq ans avec 1 milliard de dollars de chaque entreprise
En réponse aux préoccupations concernant le comportement des modèles, OpenAI a annoncé le mercredi 16 septembre 2026 qu'il publierait des mises à jour régulières sur les actions anormales des modèles, en publiant six rapports d'incidents initiaux. Le samedi 12 septembre 2026, le PDG d'Anthropic, Dario Amodei, a exhorté les laboratoires d'IA à ralentir le développement des modèles de pointe et à ouvrir leurs environnements internes à des inspecteurs tiers. Suite à l'annonce du partenariat avec Accenture vendredi après-midi, les actions d'Accenture ont augmenté de 8% à 9% lors des transactions après la clôture. Anthropic a maintenu que la supervision externe rendra la sécurité vérifiable sans réduire la responsabilité directe du développeur pour ses modèles.

