Dario Amodei, cofondateur et PDG d’Anthropic, appelle l’industrie de l’intelligence artificielle à ralentir volontairement la progression des modèles les plus avancés. Dans un essai publié samedi 12 septembre, il affirme que les capacités progressent désormais assez vite pour dépasser le rythme auquel les entreprises et les pouvoirs publics peuvent mettre en place des garde-fous.
Un plan en trois étapes
Amodei propose d’abord d’accorder à des évaluateurs indépendants un accès permanent et comparable à celui d’employés chargés de la sécurité, afin qu’ils puissent vérifier les pratiques des entreprises, examiner des incidents et évaluer les modèles pendant leur entraînement.
Il appelle ensuite les principaux laboratoires des pays démocratiques à coordonner davantage leurs pratiques de sécurité. La troisième étape viserait une coordination internationale plus large, y compris avec la Chine, tout en reconnaissant les difficultés de vérification et les enjeux géopolitiques d’un tel accord.
Anthropic dit vouloir commencer seul sur l’audit externe
Anthropic annonce qu’il appliquera unilatéralement la première partie du plan concernant les évaluateurs externes. Reuters, l’Associated Press et The Guardian rapportent que la proposition intervient dans un contexte de préoccupations croissantes autour des usages malveillants de l’IA, de la cybersécurité et de systèmes capables de contribuer eux-mêmes au développement de générations de modèles plus avancées.
Amodei ne plaide pas pour un arrêt complet de la recherche. Son argument est qu’un ralentissement ciblé de la progression des capacités pourrait donner plus de temps à l’alignement, aux tests indépendants et à la sécurité opérationnelle.
Un débat qui s’intensifie autour des modèles de pointe
Cette prise de position intervient alors que des élus américains travaillent sur de nouvelles obligations de sécurité pour les développeurs de modèles avancés et que plusieurs entreprises du secteur ont récemment publié des rapports sur des usages abusifs de leurs outils. Le débat porte désormais autant sur la vitesse de développement que sur la capacité à tester et contrôler les systèmes avant leur déploiement.



