OpenAI et Anthropic ont failli conclure un accord pour tester mutuellement leurs IA
OpenAI négocie depuis plusieurs mois un accord juridiquement contraignant avec Anthropic pour que les deux entreprises testent mutuellement la sécurité de leurs modèles d'intelligence artificielle, selon une personne directement au fait des discussions. Ces pourparlers ont débuté avant la récente vague d'incidents de cybersécurité liés à la technologie d'OpenAI et avant les mises en garde alarmantes formulées par des employés du secteur sur les dangers posés par l'IA. Face à ces inquiétudes internes et externes, OpenAI revoit actuellement l'ensemble de ses stratégies de sécurité, et ce partenariat de stress-test croisé avec son concurrent Anthropic pourrait constituer l'une des réponses à cette pression croissante.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Information AI. Lire l'article original →
Un tel accord marquerait un tournant notable dans un secteur où les grands laboratoires d'IA se livrent une concurrence féroce tout en étant confrontés aux mêmes risques systémiques. Faire évaluer ses modèles par un rival directement plutôt que uniquement par des équipes internes ou des auditeurs tiers permettrait de détecter des failles de sécurité, des comportements dangereux ou des vulnérabilités exploitables que les propres chercheurs d'une entreprise pourraient ne pas anticiper, du fait de leurs angles morts méthodologiques. Pour les utilisateurs et les régulateurs, cela enverrait un signal fort que les entreprises d'IA prennent au sérieux les risques associés à des systèmes de plus en plus puissants, et pourrait établir un précédent pour une coopération inter-industrielle sur la sécurité, même entre concurrents commerciaux directs.
Ce rapprochement intervient dans un contexte où OpenAI fait face à une pression croissante, tant de la part de ses propres employés que d'observateurs externes, concernant les dangers potentiels de ses systèmes d'IA les plus avancés. Les incidents de cybersécurité récents impliquant sa technologie ont accentué ces inquiétudes. Anthropic, fondée par d'anciens membres d'OpenAI et connue pour son positionnement axé sur la sécurité de l'IA, apparaît ainsi comme un partenaire naturel pour ce type d'initiative. Les détails précis de l'accord, notamment son calendrier et sa portée exacte, restent encore à préciser.
Pas d'impact direct sur la France/UE