Dario Amodei appelle les grands laboratoires d’intelligence artificielle à ralentir la progression de leurs modèles les plus avancés. Le patron d’Anthropic ne demande pas l’arrêt de la recherche, mais un encadrement capable de rendre les engagements de sécurité vérifiables.
La proposition repose sur trois niveaux. Le premier consiste à intégrer durablement des évaluateurs indépendants au sein des laboratoires d’IA, avec un accès suffisant aux modèles et aux procédures internes pour examiner leurs risques. Anthropic veut ainsi déplacer la sécurité d’un système largement fondé sur l’auto-évaluation vers un contrôle extérieur plus crédible.
Deuxième étape : coordonner davantage les entreprises qui développent les modèles les plus puissants. Pour Amodei, le problème est aussi économique. Une entreprise qui ralentit seule peut craindre de perdre du terrain face à ses concurrents. Une coordination sectorielle permettrait donc, en théorie, d’éviter que la pression concurrentielle ne pousse chaque acteur à accélérer malgré ses propres préoccupations de sécurité.
Le troisième niveau est international. Amodei souhaite une coopération entre États afin d’encadrer les capacités les plus sensibles et de réduire les risques liés à une course incontrôlée. Cette dimension reste la plus difficile à mettre en œuvre, notamment en raison des enjeux de compétitivité et de sécurité nationale.
Anthropic défend parallèlement un cadre réglementaire plus formel. L’entreprise propose que les développeurs de modèles de pointe soient soumis à des tests, à davantage de transparence et à des évaluations indépendantes. Elle estime également que les pouvoirs publics devraient pouvoir bloquer ou dissuader le déploiement d’un modèle présentant un risque catastrophique significatif.
Le dispositif proposé viserait notamment les modèles entraînés avec plus de 10²⁵ FLOPs, lorsqu’ils sont développés par des entreprises réalisant plus de 500 millions de dollars de revenus liés à l’IA ou dépensant plus de 1 milliard de dollars en R&D dans ce domaine.
L’enjeu dépasse donc la seule sécurité technique : Anthropic pose la question de savoir comment ralentir collectivement une industrie dont la concurrence, les capitaux et la puissance de calcul poussent précisément à aller toujours plus vite.
Chiffres clés
- 3 niveaux dans la démarche défendue par Amodei : évaluation indépendante, coordination sectorielle, coopération internationale.
- 10²⁵ FLOPs : seuil de calcul retenu dans le cadre réglementaire proposé par Anthropic.
- 500 millions de dollars : seuil de revenus IA de l’entreprise concernée.
- 1 milliard de dollars : seuil de dépenses annuelles de R&D IA prévu par le cadre


