Aller au contenu principal
Sécurité · Actu ·

Un scientifique d'Anthropic estime a plus de 10% le risque que l'IA detruise l'humanite cette decennie

Jacob Coxon, ancien chercheur en pretraining chez OpenAI puis chez Anthropic, a démissionné en accusant les deux entreprises de prendre sciemment le risque d'une extinction humaine liée à l'intelligence artificielle. Son ancien collègue chez Anthropic, Evan Hubinger, chercheur spécialisé dans l'alignement des modèles, estime pour sa part que la probabilité qu'une IA superintelligente mal alignée anéantisse l'humanité dépasse dix pour cent au cours de la prochaine décennie. Ces déclarations proviennent de deux figures ayant occupé des postes techniques centraux dans le développement des modèles de pointe, ce qui leur confère un poids particulier au sein du débat sur la sécurité de l'IA.

1 min de lecturePertinence 51

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Ces prises de position ont un impact direct sur la crédibilité du discours des laboratoires d'IA sur leurs propres pratiques de sécurité. Que des chercheurs internes, et non des critiques externes, formulent de telles estimations chiffrées renforce l'idée que les tensions entre course à la performance et prudence ne sont pas de simples spéculations théoriques mais des préoccupations partagées par ceux qui construisent ces systèmes. Pour l'industrie, cela alimente la pression en faveur d'une régulation plus stricte et d'une transparence accrue sur les méthodes d'alignement, tandis que pour le grand public, cela nourrit l'inquiétude quant au rythme effréné du déploiement de modèles toujours plus puissants sans garanties suffisantes.

Anthropic s'est historiquement positionnée comme le laboratoire le plus attentif aux risques existentiels liés à l'IA, employant plusieurs chercheurs, dont Hubinger, dédiés à l'étude de l'alignement et de la sécurité. Ce départ et ces déclarations interviennent alors que la compétition entre OpenAI, Anthropic, Google DeepMind et d'autres acteurs s'intensifie autour du développement de systèmes de plus en plus autonomes. Le débat oppose ceux qui jugent ces risques exagérés à ceux qui estiment que l'accélération actuelle du secteur ne laisse pas suffisamment de place à la recherche en sécurité, une tension qui pourrait s'accentuer à mesure que de nouveaux modèles plus capables seront annoncés.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Anthropic estime à plus d'une chance sur dix que l'IA "pourrait tuer toute l'humanité", après la démission d'un collègue59The Verge AISécurité 02Anthropic : Claude rédige plus de 90 % de son code et plaide pour un bouton pause mondial de l'IA49The DecoderSécurité 03Une « erreur humaine » provoque la fuite de Claude Mythos : le prochain modèle d’Anthropic qui inquiète jusqu’à ses créateurs52NumeramaSécurité 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.