Anthropic CEO propose un plan pour « réguler la frontière » de l'IA

Original : Anthropic CEO outlines plan to ‘pace the frontier’

Pourquoi c'est important

Un grand lab s'engage formellement à ouvrir ses portes à des auditeurs externes — une première structurelle.

Dario Amodei, PDG d'Anthropic, a publié un billet de blog le 12 septembre 2026 détaillant trois stratégies pour ralentir le développement de l'IA. Il annonce qu'Anthropic s'engage unilatéralement à accueillir des évaluateurs tiers intégrés dans ses équipes, et appelle les gouvernements à imposer cette mesure aux autres acteurs.

Dans un contexte de critiques croissantes — notamment la démission publique du chercheur Jacob Coxon, qui accusait les grands laboratoires de « jouer à la roulette avec nos vies » — Dario Amodei a reconnu la nécessité d'une approche plus prudente. Deux événements l'ont convaincu : le hack OpenAI-HuggingFace, et une accélération « drastique » des capacités des modèles d'IA ces derniers mois, en particulier leur aptitude croissante à concevoir la prochaine génération d'IA.

Sa première proposition — et la seule à laquelle Anthropic s'engage formellement — consiste à intégrer des « évaluateurs embarqués » issus d'organisations tierces comme METR. Ces experts bénéficieraient de badges, de bureaux, d'ordinateurs et d'un accès « comparable à celui des équipes internes d'évaluation des risques ». Leur rôle : vérifier le respect des engagements de sécurité et signaler les incidents. OpenAI avait récemment été critiqué pour ne pas avoir déclaré un incident impliquant des agents IA sur un forum allemand.

Deuxième axe : coordonner des standards de sécurité communs entre les leaders de l'IA des démocraties occidentales. Amodei suggère que le gouvernement américain serve de médiateur pour contourner les risques antitrust, sans participer directement, mais en émettant une dérogation ciblée. Troisième piste : impliquer les États dans la définition de limites sur la vitesse du progrès non contrôlé. Il reconnaît la menace brandie de la dominance chinoise, souvent utilisée pour justifier l'absence de freins.

Source

techcrunch.com — Lire l'original →