Anthropic ouvre ses modèles à Accenture : l’évaluateur sera payé par l’évalué

|Auteur: Équipe éditoriale de QUASA|5 min de lecture
Anthropic ouvre ses modèles à Accenture : l’évaluateur sera payé par l’évalué

Le 18 septembre 2026, Anthropic et Accenture ont annoncé la création d’une équipe d’évaluateurs intégrés dirigée par Faculty, l’entité spécialisée en intelligence artificielle d’Accenture. Elle doit travailler avec les équipes internes et les partenaires de sécurité d’Anthropic pour évaluer les modèles, mener des tests contradictoires, examiner leur alignement et éprouver leurs garde-fous, selon la dépêche Reuters du 18 septembre.

Le dispositif promet un accès comparable à celui d’un salarié, mais pas une indépendance financière. Dans sa présentation de l’évaluation intégrée, Anthropic précise qu’elle paiera directement Accenture, conserve l’entière responsabilité de la sécurité de ses modèles, reconnaît l’absence de normes communes d’accès, de publication et de financement, mentionne des discussions avec METR et d’autres organismes à but non lucratif sur des pilotes autofinancés, et prévoit d’accueillir d’autres évaluateurs dans les semaines suivantes.

Un accès au développement, pas seulement au produit fini

La principale nouveauté tient au moment et à la profondeur du contrôle. Faculty doit pouvoir observer les modèles pendant leur entraînement, suivre les décisions qui encadrent leur construction et leur déploiement, et échanger directement avec les salariés concernés. Une évaluation externe classique intervient plus souvent sur une version déterminée du système, avec un périmètre et des informations fournis par le laboratoire.

Cette présence interne peut révéler des angles morts invisibles dans un test ponctuel : changements entre deux versions, arbitrages ayant réduit une protection ou écarts entre un engagement de sécurité et sa mise en œuvre. Elle peut aussi permettre de signaler un incident avant la sortie d’un modèle, plutôt que d’en mesurer les effets après son déploiement.

L’accès promis ne donne toutefois à Faculty aucun pouvoir réglementaire. Il ne constitue ni une certification publique, ni un transfert de responsabilité, ni la garantie que tous les constats pourront être publiés. Le dispositif reste une mission privée réalisée à l’intérieur de l’entreprise examinée.

Accès, mission et publication : les garanties encore manquantes

  • Accès promis : une présence interne comparable à celle d’un salarié, incluant l’observation de l’entraînement et des décisions de développement et de déploiement.
  • Travaux prévus : évaluation des capacités et des comportements, red teaming, contrôles d’alignement et tests des garde-fous.
  • Gouvernance financière : Anthropic rémunérera directement Accenture pour la mission ; le prix de cette prestation n’est pas rendu public.
  • Signalement : les évaluateurs doivent pouvoir remonter des incidents et contribuer à informer le public, mais les annonces ne définissent ni procédure formelle ni voie de divulgation en cas de désaccord.
  • Publication : aucun droit contractuel de publier un résultat défavorable, une méthodologie ou les limites d’accès n’est détaillé.
  • Standards : aucun référentiel commun ne fixe encore les informations accessibles, les méthodes à appliquer ou la forme des comptes rendus.

Ces inconnues sont déterminantes. Un évaluateur peut disposer d’informations privilégiées tout en restant incapable d’exposer une faiblesse importante si son mandat, les règles de confidentialité ou l’autorisation de son client limitent la communication publique.

Un financement distinct du milliard annoncé par chaque groupe

Le paiement direct crée un conflit structurel : l’organisation évaluée finance celle qui doit examiner ses modèles et certaines de ses pratiques. Ce lien ne prouve pas que les conclusions de Faculty seront biaisées, d’autant qu’aucun résultat issu de cette mission n’a encore été publié. Il oblige néanmoins à distinguer l’indépendance juridique d’Accenture de l’autonomie opérationnelle de l’équipe.

Par ailleurs, les sommes annoncées ne correspondent pas au prix du contrôle confié à Faculty. Le communiqué conjoint publié par Accenture prévoit que chaque entreprise investisse au moins un milliard de dollars sur cinq ans dans la sécurité de l’IA et les capacités associées. Il ne présente pas ces deux milliards comme une enveloppe entièrement versée à l’équipe intégrée.

L’autonomie réelle dépendra donc de garanties qui ne sont pas encore publiques : liberté de sélectionner les tests, accès aux versions pertinentes, possibilité de documenter un refus d’accès, traitement des désaccords et faculté de communiquer un constat défavorable. La taille et la composition de l’équipe, son calendrier ainsi que les clauses de confidentialité restent également inconnus.

Plusieurs évaluateurs, mais aucun cadre commun

Le partenariat n’est pas exclusif : Anthropic entend travailler avec plusieurs organismes, tandis qu’Accenture pourra exercer une fonction comparable auprès d’autres développeurs d’IA. Cette pluralité peut réduire la dépendance à un contrôleur unique et permettre de confronter différentes méthodes.

Elle ne rend cependant pas les évaluations comparables par elle-même. Deux équipes peuvent recevoir des accès différents, tester des versions distinctes et ne pas disposer des mêmes droits de publication. Sans socle commun, une conclusion rassurante pourrait être impossible à comparer avec un constat plus prudent produit sous un autre mandat.

Des financements mutualisés ou publics réduiraient la dépendance directe envers le laboratoire examiné, mais aucun mécanisme de ce type n’encadre actuellement la mission d’Accenture. Les pilotes envisagés avec des organismes à but non lucratif disposant de leurs propres ressources pourraient offrir un point de comparaison, sans constituer pour l’instant un standard partagé.

La première publication montrera la portée du contrôle

À ce stade, le partenariat établit un mandat, un principe d’accès interne et une relation financière, pas une évaluation indépendante achevée. Les annonces ne fournissent ni premier rapport, ni protocole public de signalement, ni règles détaillées pour publier les résultats et leurs limites.

Le prochain test sera donc observable : savoir quelles méthodes seront décrites, quels accès auront réellement été accordés et comment un désaccord avec Anthropic sera rendu visible. Tant que ces éléments ne sont pas fixés, « indépendant » désigne surtout la séparation organisationnelle de l’évaluateur, et non une indépendance financière ou éditoriale démontrée.

À lire aussi:

Partager:

Abonnez-vous à notre newsletter

Recevez directement les dernières actualités sur le Web3, l’IA et les cryptomonnaies.

0