Évaluateurs intégrés : Anthropic et Accenture misent 1 G$ chacun
· 5 min de lecture · Gouvernance IA
Anthropic a nommé le 18 septembre 2026 Accenture comme premier évaluateur intégré de ses modèles, chaque partie prévoyant investir au moins 1 G$ US sur cinq ans. Ce que ce dispositif prouve, et ce qu'il ne prouve pas, pour une organisation qui achète de l'IA.
Un évaluateur intégré (embedded evaluator) est une équipe externe installée à demeure chez un développeur de modèles d'intelligence artificielle (IA), dotée d'un accès comparable à celui d'un employé, pour tester les modèles, vérifier les procédures de sécurité et signaler les incidents. Le 18 septembre 2026, Anthropic a nommé Accenture premier évaluateur intégré de son histoire. Chacune des deux entreprises prévoit investir au moins 1 milliard de dollars américains sur cinq ans.
L'annonce concrétise la première étape d'un plan publié six jours plus tôt. Le 12 septembre 2026, Dario Amodei, PDG d'Anthropic, a publié l'essai « We Must Pace the Frontier » : ralentir la progression des capacités en trois temps, d'abord des évaluateurs tiers intégrés aux laboratoires, puis une coordination volontaire entre développeurs, enfin une coordination internationale. Le même jour, Sam Altman a écrit sur X qu'OpenAI ferait de même, sans nommer d'évaluateur ni fixer d'échéance.
Qu'est-ce qu'un évaluateur intégré et que fait-il exactement ?
Selon l'annonce publiée par Anthropic le 18 septembre 2026, le mandat confié à Accenture couvre quatre activités : l'évaluation des modèles, le red teaming (tests adverses menés par une équipe qui cherche à faire échouer le système), les évaluations d'alignement et les tests des garde-fous.
Ce qui distingue ce dispositif d'un audit classique, c'est le niveau d'accès. Anthropic indique que les évaluateurs bénéficieront d'un accès « comparable à celui d'un employé » : observer l'entraînement des modèles, suivre les décisions internes et parler directement aux équipes. Un audit de conformité porte sur des artefacts transmis après coup. Ici, l'évaluateur voit le processus pendant qu'il se déroule.
Le mandat est piloté par Faculty, la division spécialisée en IA d'Accenture. L'entente n'est pas exclusive : Anthropic poursuit des discussions avec METR et d'autres organismes sans but lucratif pour piloter une évaluation intégrée financée par leurs propres fonds.
Pourquoi le choix d'Accenture soulève une question d'indépendance
Trois éléments de structure méritent l'attention d'un acheteur d'IA.
Premièrement, c'est Anthropic qui finance directement le travail d'Accenture : l'évaluateur est payé par l'entité qu'il évalue.
Deuxièmement, Accenture est l'un des plus grands intégrateurs mondiaux de solutions d'IA. La même organisation qui teste les garde-fous d'un modèle vend par ailleurs le déploiement de ce type de modèle à des entreprises clientes.
Troisièmement, les communiqués du 18 septembre 2026 ne précisent ni la taille de l'équipe, ni la date de démarrage, ni les droits de publication de l'évaluateur. TechCrunch soulignait dès le 16 septembre 2026 que sans droit de publier des constats défavorables, un évaluateur intégré produit de l'assurance interne, pas de la transparence opposable.
5 questions à poser à un fournisseur d'IA sur son évaluation externe
- Qui paie l'évaluateur et selon quel contrat ? Un mandat financé par l'entité évaluée n'est pas disqualifiant, mais il doit figurer tel quel au dossier de diligence.
- L'évaluateur peut-il publier des constats défavorables ? Sans droit de publication ni signalement à un régulateur, l'évaluation reste un contrôle interne du fournisseur.
- Que couvre le périmètre ? Un modèle de fondation évalué ne dit rien de la sécurité de l'application déployée par-dessus.
- À quelle fréquence l'évaluation est-elle refaite ? Une évaluation vaut pour une version. Exigez un délai de notification contractuel avant tout changement de modèle.
- Quels artefacts recevez-vous ? Rapport complet, résumé exécutif ou simple attestation : seul le premier alimente une évaluation des facteurs relatifs à la vie privée.
Ce que l'évaluation tierce ne transfère pas au Québec
Au Québec, la responsabilité légale ne suit pas le modèle : elle reste chez l'organisation qui l'utilise. La Loi 25 impose une évaluation des facteurs relatifs à la vie privée (EFVP) avant tout projet d'acquisition ou de développement d'un système d'information impliquant des renseignements personnels. Elle impose aussi, depuis le 22 septembre 2023, d'informer une personne lorsqu'une décision la concernant repose exclusivement sur un traitement automatisé.
Aucun de ces devoirs ne se délègue au fournisseur, ni à l'évaluateur du fournisseur. Un rapport d'Accenture sur les garde-fous d'un modèle d'Anthropic documente le modèle. Il ne documente ni votre cas d'usage, ni vos données, ni vos contrôles d'accès.
Le Règlement (UE) 2024/1689, l'AI Act européen, suit la même logique : son article 55 impose au fournisseur d'un modèle à risque systémique une évaluation contradictoire et le signalement des incidents graves, sans exonérer le déployeur. La Commission européenne a adressé fin août 2026 ses premières demandes formelles à plus de 30 fournisseurs.
La séquence de septembre 2026 est cohérente : la fiche système de GPT-6 Astra publiée le 3 septembre a exposé les limites de l'auto-évaluation, l'annonce du 18 septembre y oppose une réponse de marché. L'échéance utile pour un acheteur reste la publication du premier rapport d'évaluation intégrée, seul élément qui transformera cet engagement en preuve.
Questions fréquentes
Qu'est-ce qu'un évaluateur intégré en intelligence artificielle ?
Un évaluateur intégré est une équipe externe installée en permanence chez un développeur de modèles d'IA, avec un accès comparable à celui d'un employé. Elle teste les modèles, mène du red teaming, évalue l'alignement et vérifie les garde-fous pendant l'entraînement, plutôt qu'après la mise en marché.
L'évaluation tierce d'un modèle dispense-t-elle d'une EFVP au Québec ?
Non. La Loi 25 impose l'évaluation des facteurs relatifs à la vie privée à l'organisation qui acquiert ou développe le système, pas à son fournisseur. Un rapport externe portant sur un modèle de fondation est une pièce utile au dossier, jamais un substitut à l'analyse de votre cas d'usage.
Un évaluateur payé par le laboratoire qu'il évalue est-il indépendant ?
L'indépendance dépend du contrat, pas seulement du financement. Les critères à vérifier sont le droit de publier des constats défavorables, l'accès aux processus d'entraînement et non aux seuls modèles finis, et l'absence de veto du laboratoire sur la portée des tests. L'annonce du 18 septembre 2026 ne précise aucun de ces points.
Combien Anthropic et Accenture investissent-ils dans ce dispositif ?
Chaque entreprise prévoit investir au moins 1 milliard de dollars américains sur cinq ans, selon les communiqués publiés le 18 septembre 2026. Ni la taille de l'équipe d'évaluateurs, ni la date de démarrage n'ont été communiquées.
Sources
- Anthropic, « Partnering with Accenture on embedded evaluation », 18 septembre 2026 : https://www.anthropic.com/news/accenture-embedded-evaluation
- Accenture Newsroom, « Accenture and Anthropic Partner to Build Team of Embedded Evaluators at Anthropic », 18 septembre 2026 : https://newsroom.accenture.com/news/2026/accenture-and-anthropic-partner-to-build-team-of-embedded-evaluators-at-anthropic
- TechCrunch, « Anthropic's first embedded evaluator is Accenture », 18 septembre 2026 : https://techcrunch.com/2026/09/18/anthropics-first-embedded-evaluator-is-accenture/
- TechCrunch, « Anthropic and OpenAI want to embed safety evaluators. Will they really be independent? », 16 septembre 2026 : https://techcrunch.com/2026/09/16/anthropic-and-openai-want-to-embed-safety-evaluators-will-they-really-be-independent/
- EUR-Lex, Règlement (UE) 2024/1689 établissant des règles harmonisées concernant l'intelligence artificielle, article 55 : http://data.europa.eu/eli/reg/2024/1689/oj
- LégisQuébec, Loi sur la protection des renseignements personnels dans le secteur privé (RLRQ, c. P-39.1), articles 3.3 et 12.1 : https://www.legisquebec.gouv.qc.ca/fr/document/lc/P-39.1
Voir tous les articles