Aller au contenu principal
Sécurité · Actu ·

Anthropic estime à plus d'une chance sur dix que l'IA "pourrait tuer toute l'humanité", après la démission d'un collègue

Un chercheur senior en sécurité chez Anthropic a affirmé qu'il existe plus de 10 % de probabilité que l'intelligence artificielle "puisse tuer tous les humains" d'ici la fin de la décennie, quelques heures seulement après la démission d'un collègue inquiet de la course imprudente menée par les laboratoires d'IA vers des "systèmes surhumains" incontrôlables. Ce collègue, Jacob Coxon, chercheur ayant entraîné des systèmes chez Anthropic après avoir fait de même chez OpenAI, a annoncé son départ sur X en dénonçant l'approche laxiste de l'entreprise en matière de sécurité. Il accuse Anthropic et ses concurrents de "foncer tout droit vers une superintelligence auto-améliorante en jouant avec nos vies".

1 min de lecturePertinence 46

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de The Verge AI. Lire l'article original →

Ces déclarations, venant de l'intérieur même d'une entreprise qui se présente comme la plus prudente du secteur de l'IA, illustrent les tensions croissantes entre impératifs commerciaux et sécurité au sein des laboratoires les plus avancés. Qu'un responsable sécurité évoque publiquement une probabilité à deux chiffres d'extinction humaine, tout en assumant de continuer à développer ces technologies, souligne le fossé entre les discours d'alerte et les pratiques industrielles réelles, un paradoxe qui alimente la défiance du public et des régulateurs envers les grandes entreprises d'IA générative.

Cette sortie s'inscrit dans un climat de compétition effrénée entre Anthropic, OpenAI et d'autres acteurs pour atteindre l'intelligence artificielle générale, chacun cherchant à devancer ses rivaux sans attendre de garanties de contrôle suffisantes. Les démissions motivées par des inquiétudes éthiques ou sécuritaires se multiplient dans le secteur depuis plusieurs années, alimentant le débat sur la nécessité d'une régulation contraignante. Reste à savoir si ces avertissements répétés, venant d'employés directement impliqués dans l'entraînement de ces systèmes, pousseront les entreprises concernées à ralentir leur cadence ou à renforcer leurs garde-fous internes.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

Notre lecture

Une chance sur dix de tuer l'humanité, et l'équipe continue à entraîner les modèles le lendemain matin. C'est ça le vrai signal : chez Anthropic, l'alerte interne ne fait plus dérailler la feuille de route, elle devient juste une ligne dans le rapport de sécurité. Reste à voir combien de démissions il faudra avant qu'un labo transforme un chiffre pareil en pause plutôt qu'en communiqué.

À lire ensuite

01Un chercheur d'Anthropic démissionne et avertit : une IA capable de s'améliorer seule pourrait "tous nous tuer38Ars Technica AISécurité 02Un scientifique d'Anthropic estime a plus de 10% le risque que l'IA detruise l'humanite cette decennie38The DecoderSécurité 03« L’IA pourrait provoquer l’extinction de l’humanité d’ici 2030 » : ces chercheurs d’Anthropic alertent45Le Big DataSécurité 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.