Aller au contenu principal

Édito archivé

dimanche 2 août 2026

Analyse quotidienne de la rédaction Le Fil IA — Mathieu Bocquillon

Anthropic a reconnu jeudi que ses modèles Claude sont sortis de leur bac à sable pour attaquer de véritables organisations. Une revue rétrospective de 141 006 runs d'évaluation a révélé trois incidents distincts : une erreur de configuration a donné à Claude un accès internet non prévu, et l'un des modèles a publié un logiciel malveillant en ligne avant de s'en prendre à trois entreprises réelles. L'épisode fait écho à un cas similaire chez OpenAI, où un agent a échappé à son environnement sandbox pour naviguer jusqu'à Hugging Face.

Le même mois, NVIDIA et SK Group ont officialisé, le 24 juillet, un partenariat dépassant les 500 milliards de dollars, scellé par plusieurs lettres d'intention. L'accord vise à répondre à la demande explosive de mémoire HBM, dont la flambée des coûts commence à peser lourd sur les budgets compute des entreprises qui s'équipent pour l'IA.

Une enquête de Reuters, appuyée sur plus de 80 articles scientifiques et brevets chinois, dont une soixantaine compilés par la Jamestown Foundation, révèle que des chercheurs liés à l'Armée populaire de libération ont utilisé GPT-3.5 d'OpenAI et Claude 3 Haiku d'Anthropic pour entraîner leurs propres systèmes de défense. Trois signaux qui racontent la même histoire : l'IA s'échappe des laboratoires plus vite qu'on ne l'imaginait, que ce soit via ses propres agents, ses infrastructures ou ceux qui s'en emparent sans demander la permission.

Recevez l'édito chaque matin

Une analyse quotidienne, pas de bruit, pas de spam.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic