Anthropic paie son évaluateur intégré — l’indépendance devra se prouver

Anthropic et Accenture ont annoncé le 18 septembre 2026 la création d’une équipe d’évaluateurs intégrés appelée à travailler auprès des équipes internes et des partenaires de sécurité d’Anthropic. Piloté par Faculty, l’activité spécialisée en IA d’Accenture, le dispositif couvrira l’évaluation et le red teaming des modèles, les examens d’alignement et les tests des garde-fous, détaille le communiqué d’Accenture.
Anthropic financera directement le travail d’Accenture, tandis que les évaluateurs disposeront d’un accès comparable à celui de salariés. La présentation du partenariat par Anthropic reconnaît qu’il n’existe encore ni normes communes sur les informations accessibles et la publication des constats, ni système stabilisé de financement indépendant.
Un accès interne, sans pouvoir de contrôle final
La nouveauté tient à la place de l’évaluateur dans le cycle de développement. Au lieu d’examiner uniquement un modèle achevé depuis l’extérieur, l’équipe doit pouvoir observer les modèles pendant leur entraînement, suivre les décisions relatives à leur construction et à leur déploiement, et échanger directement avec les salariés concernés.
Cet accès peut permettre de confronter plus tôt les engagements de sécurité aux pratiques réelles, de repérer des angles morts et de signaler des incidents. Il ne transforme toutefois pas Faculty en régulateur et ne lui donne pas, d’après les informations rendues publiques, de pouvoir final sur le lancement ou le retrait d’un modèle.
La responsabilité de la sécurité des modèles reste à la charge d’Anthropic. Cette séparation est centrale : Faculty pourra produire des constats et contester des choix, mais l’entreprise évaluée conservera la décision opérationnelle, sauf intervention d’une autorité extérieure. L’accès interne augmente donc la capacité d’observation sans créer, à lui seul, une autorité indépendante.
Deux milliards de capacité, pas deux milliards d’honoraires
Anthropic et Accenture prévoient chacune d’investir au moins un milliard de dollars au cours des cinq prochaines années pour développer leurs capacités dans ce domaine. Le compte rendu de TechCrunch confirme cette échelle d’investissement et indique que d’autres évaluateurs doivent être annoncés dans les semaines suivant le partenariat.
L’addition atteint au moins deux milliards de dollars, mais ce total résulte des investissements prospectifs des deux entreprises. Il ne correspond pas à un contrat de deux milliards versé par Anthropic à Faculty ou à Accenture.
La rémunération de la mission constitue un flux distinct : Anthropic paiera directement Accenture. Aucun montant, barème, calendrier de paiement ou mécanisme protégeant l’équipe contre une interruption de son financement après un constat défavorable n’a été publié. La séparation juridique des organisations ne suffit donc pas à établir l’indépendance fonctionnelle de l’évaluation.
Le montage est présenté comme une étape avant l’éventuelle création de financements mutualisés ou publics. Ceux-ci n’existent pas encore sous une forme établie. Des discussions sont également en cours avec METR et d’autres organisations à but non lucratif pour expérimenter certains éléments de l’évaluation intégrée avec leurs propres ressources.
L’indépendance se jouera sur cinq dimensions
Le conflit potentiel ne se résume pas à l’identité du payeur. Pour apprécier le dispositif, il faut distinguer cinq dimensions que le terme « indépendant » réunit trop facilement :
- Accès : les données, décisions, personnes et phases de développement que Faculty pourra réellement examiner, ainsi que la traçabilité des éventuels refus.
- Mandat : les modèles, garde-fous, incidents et décisions de déploiement inclus dans les évaluations.
- Financement : la durée de la mission, ses conditions et les protections contre une pression économique liée aux conclusions.
- Publication : la possibilité de rendre publics les constats, les désaccords et les limites de l’accès sans veto indu de l’entreprise évaluée.
- Responsabilité : l’entité qui répond des décisions prises ou maintenues après une alerte.
Les informations disponibles apportent une réponse partielle sur l’accès, le mandat général et l’origine du financement. Elles ne fixent pas de règles communes pour la publication, le règlement des désaccords ou la comparaison des évaluations entre laboratoires. Elles ne précisent pas non plus quelles données d’entraînement, quels journaux techniques ou quels incidents Faculty pourra consulter sans restriction.
Plusieurs évaluateurs ne créent pas une norme commune
L’accord n’est pas exclusif : Anthropic prévoit de travailler avec plusieurs organisations, et Accenture pourra remplir une fonction comparable auprès d’autres développeurs d’IA. Cette pluralité peut réduire la dépendance à une seule équipe, mais elle ne garantit ni des méthodes identiques ni un accès équivalent.
Sans exigences partagées sur les informations consultables, la gestion des conflits d’intérêts et la communication des résultats, deux évaluateurs pourraient recevoir des éléments différents ou produire des constats impossibles à comparer. Il reste également à déterminer si un désaccord majeur sera publié, résumé par Anthropic ou conservé dans le cadre contractuel.
À ce stade, le partenariat porte sur une capacité d’évaluation à construire. Aucun rapport achevé, résultat de test ou mécanisme de certification n’a été présenté. Les prochaines preuves attendues concernent donc le périmètre effectif de la mission, les droits de publication et le traitement d’un éventuel constat défavorable : l’accès interne est annoncé, mais l’indépendance devra se vérifier lorsque les intérêts de l’évaluateur et de son financeur divergeront.
À lire aussi:
Abonnez-vous à notre newsletter
Recevez directement les dernières actualités sur le Web3, l’IA et les cryptomonnaies.