Anthropic affirme que GLM-5.3, le modèle open-weight de Zhipu, égale presque Claude Mythos Preview pour créer des exploits
Anthropic affirme que GLM-5.3, le modèle à poids ouverts du chinois Zhipu, écrit des exploits informatiques presque aussi bien que Claude Mythos Preview, son propre modèle réservé aux usages encadrés. Selon l'entreprise, la variante allégée Flash de GLM-5.3 a assemblé une attaque fiable contre Chrome pour seulement 20,40 dollars, aux tarifs de l'API de Zhipu. Les protections intégrées au modèle se contournent facilement, et des versions débridées circulent déjà en ligne. L'agence américaine CAISI, chargée d'évaluer les modèles d'IA, confirme ces conclusions dans ses propres tests.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →
L'enjeu est concret pour les défenseurs comme pour les attaquants. Une capacité offensive jusque-là limitée à quelques modèles de pointe, contrôlés par leurs éditeurs, devient accessible à n'importe qui pour le prix d'un déjeuner. Un modèle à poids ouverts se télécharge, se modifie et s'exécute sans supervision, de sorte que les garde-fous ajoutés par l'éditeur ne pèsent presque rien une fois les fichiers diffusés. Les équipes de sécurité, les éditeurs de navigateurs et les responsables de correctifs doivent donc s'attendre à voir le délai entre la découverte d'une faille et son exploitation se réduire nettement.
Le constat s'inscrit dans un débat plus large sur le risque des modèles ouverts, alors que l'écart entre laboratoires américains et chinois se resserre. Anthropic a ses propres raisons de tirer la sonnette d'alarme : l'entreprise défend une approche fondée sur l'accès contrôlé à ses modèles les plus puissants et plaide pour un encadrement plus strict. Le fait qu'un organisme public américain corrobore les résultats affaiblit toutefois l'idée d'un simple argument commercial. La suite dépendra des réactions de Zhipu, d'un éventuel durcissement des règles américaines sur les modèles ouverts et de la capacité des défenseurs à utiliser les mêmes outils pour corriger les failles avant qu'elles ne soient exploitées.
Les équipes de sécurité et éditeurs de navigateurs européens doivent anticiper un délai réduit entre découverte de faille et exploitation, et le débat sur l'encadrement des modèles ouverts concerne aussi l'AI Act.