Kimi K3 en tête, Demis présente son grand plan pour la régulation de l'IA
L'Institut britannique de sécurité de l'IA (AISI) a publié une analyse comparant les capacités cyber des modèles à poids ouverts et des modèles propriétaires, et l'écart entre les deux se réduit nettement. Sur un ensemble de 70 tests évaluant des capacités cyber précises, le modèle ouvert GLM-5.2 atteint désormais un niveau proche de Claude Opus 4.6, sorti seulement 4,3 mois plus tôt, tandis que DeepSeek V4-Pro se situe entre Claude Opus 4.5 et GPT-5, publiés respectivement en novembre et août 2025. Selon l'AISI, l'écart typique entre modèles ouverts et fermés était de 6 à 10 mois durant la majeure partie de 2025 ; il n'est plus que de 4 à 7 mois aujourd'hui. Sur des tests plus complexes, dits de "long horizon", qui évaluent la capacité d'un modèle à enchaîner plusieurs étapes pour mener une opération de piratage complète, l'écart reste plus marqué : sur le banc d'essai "The Last Ones", GLM-5.2 égale Opus 4.5 (sorti moins de 7 mois avant lui) mais DeepSeek V4-Pro reste en dessous de Sonnet 4.5. Parallèlement, la société chinoise Kimi a dévoilé Kimi K3, un modèle de 2,8 billions de paramètres qui affiche des scores très solides sur la plupart des benchmarks standards, se rapprochant de Claude Fable 5 et GPT 5.6 Sol sans toutefois les égaler.
Cette réduction de l'écart a une conséquence directe pour la cybersécurité mondiale : les capacités offensives aujourd'hui réservées aux modèles propriétaires, encadrées par des garde-fous internes, pourraient bientôt être accessibles librement via des poids ouverts, sans les mêmes protections. L'AISI parle d'une "fenêtre courte" pour que les équipes de défense se préparent à cette diffusion. Pour l'industrie, cela signifie aussi que la distinction entre acteurs contrôlés et diffusion incontrôlée de capacités de pointe devient de plus en plus ténue, ce qui complique la régulation et la gestion des risques à l'échelle internationale.
Ce basculement s'inscrit dans une dynamique plus large où les entreprises chinoises, après avoir dominé le marché des modèles ouverts avec des acteurs comme DeepSeek, commencent aussi à rattraper la frontière des modèles propriétaires. Kimi K3 illustre cette progression, même si ses résultats trahissent parfois un phénomène de surajustement aux benchmarks, une forme de généralisation plus fragile que celle des meilleurs modèles fermés. Le modèle a par ailleurs été testé sur des tâches d'auto-amélioration récursive, notamment la conception de compilateurs GPU : il a produit MiniTriton, un compilateur compact inspiré de Triton, doté de sa propre couche de représentation intermédiaire au niveau des tuiles construite sur MLIR, avec des passes d'optimisation et un pipeline de génération de code PTX. Les poids de Kimi K3 doivent être publiés dans les prochaines semaines, accompagnés d'un article de recherche détaillant le modèle.
Les équipes de cybersécurité européennes devront elles aussi anticiper la diffusion de capacités offensives comparables via des modèles à poids ouverts, sans qu'aucune entreprise ou régulation française ne soit directement citée dans ce rapport.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.



