Aller au contenu principal
SécuritéImport AI · 2 min de lecture

Kimi K3 en tête, Demis présente son grand plan pour la régulation de l'IA

Source originale ↗·

L'Institut britannique de sécurité de l'IA (AISI) a publié une analyse comparant les capacités cyber des modèles à poids ouverts et des modèles propriétaires, et l'écart entre les deux se réduit nettement. Sur un ensemble de 70 tests évaluant des capacités cyber précises, le modèle ouvert GLM-5.2 atteint désormais un niveau proche de Claude Opus 4.6, sorti seulement 4,3 mois plus tôt, tandis que DeepSeek V4-Pro se situe entre Claude Opus 4.5 et GPT-5, publiés respectivement en novembre et août 2025. Selon l'AISI, l'écart typique entre modèles ouverts et fermés était de 6 à 10 mois durant la majeure partie de 2025 ; il n'est plus que de 4 à 7 mois aujourd'hui. Sur des tests plus complexes, dits de "long horizon", qui évaluent la capacité d'un modèle à enchaîner plusieurs étapes pour mener une opération de piratage complète, l'écart reste plus marqué : sur le banc d'essai "The Last Ones", GLM-5.2 égale Opus 4.5 (sorti moins de 7 mois avant lui) mais DeepSeek V4-Pro reste en dessous de Sonnet 4.5. Parallèlement, la société chinoise Kimi a dévoilé Kimi K3, un modèle de 2,8 billions de paramètres qui affiche des scores très solides sur la plupart des benchmarks standards, se rapprochant de Claude Fable 5 et GPT 5.6 Sol sans toutefois les égaler.

Cette réduction de l'écart a une conséquence directe pour la cybersécurité mondiale : les capacités offensives aujourd'hui réservées aux modèles propriétaires, encadrées par des garde-fous internes, pourraient bientôt être accessibles librement via des poids ouverts, sans les mêmes protections. L'AISI parle d'une "fenêtre courte" pour que les équipes de défense se préparent à cette diffusion. Pour l'industrie, cela signifie aussi que la distinction entre acteurs contrôlés et diffusion incontrôlée de capacités de pointe devient de plus en plus ténue, ce qui complique la régulation et la gestion des risques à l'échelle internationale.

Ce basculement s'inscrit dans une dynamique plus large où les entreprises chinoises, après avoir dominé le marché des modèles ouverts avec des acteurs comme DeepSeek, commencent aussi à rattraper la frontière des modèles propriétaires. Kimi K3 illustre cette progression, même si ses résultats trahissent parfois un phénomène de surajustement aux benchmarks, une forme de généralisation plus fragile que celle des meilleurs modèles fermés. Le modèle a par ailleurs été testé sur des tâches d'auto-amélioration récursive, notamment la conception de compilateurs GPU : il a produit MiniTriton, un compilateur compact inspiré de Triton, doté de sa propre couche de représentation intermédiaire au niveau des tuiles construite sur MLIR, avec des passes d'optimisation et un pipeline de génération de code PTX. Les poids de Kimi K3 doivent être publiés dans les prochaines semaines, accompagnés d'un article de recherche détaillant le modèle.

Impact France/UE

Les équipes de cybersécurité européennes devront elles aussi anticiper la diffusion de capacités offensives comparables via des modèles à poids ouverts, sans qu'aucune entreprise ou régulation française ne soit directement citée dans ce rapport.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1Next INpact 

Microsoft officialise son utilisation intensive de l’IA pour la découverte des failles

Microsoft a publié un long billet de blog détaillant pour la première fois de façon approfondie l'usage intensif de l'intelligence artificielle générative dans la découverte des failles de sécurité de ses produits, Windows en tête. L'entreprise avait déjà évoqué brièvement le sujet en mai 2026, indiquant que ses équipes d'ingénieurs recouraient de plus en plus aux grands modèles de langage pour traquer les vulnérabilités. Le mois suivant, en juin, le traditionnel « Patch Tuesday », ce deuxième mardi du mois où Microsoft diffuse ses correctifs de sécurité, a marqué un record historique avec près de 200 failles colmatées en une seule fournée. Ce chiffre confirme que l'annonce de mai n'était pas un effet d'annonce isolé mais bien le signe d'un changement de méthode durable dans la manière dont l'éditeur traque et corrige les failles de ses logiciels. Cette bascule vers l'IA générative dans le cycle de sécurité a des conséquences concrètes pour les entreprises et les particuliers qui utilisent Windows et les autres produits Microsoft. L'éditeur explique avoir fait évoluer ses systèmes d'ingénierie et de validation afin de réduire le délai entre la découverte d'une vulnérabilité et la mise à disposition d'un correctif pour les clients, en concentrant l'effort sur les zones jugées les plus à risque. Les modèles sont désormais intégrés plus tôt dans le cycle de développement, ce qui permet de repérer des problèmes que les méthodes traditionnelles auraient mis plus de temps à révéler. Microsoft prévient toutefois d'ores et déjà ses clients qu'ils doivent s'attendre à un volume plus élevé de mises à jour de sécurité à chaque publication mensuelle, un changement d'échelle qui touchera directement les équipes informatiques chargées de déployer ces correctifs. Reste que l'automatisation de la recherche de failles par l'IA soulève une question de fond : l'expertise humaine garde-t-elle la main ? Microsoft insiste sur le fait que l'évaluation des vulnérabilités, l'arbitrage sur les risques et la vérification de la qualité des correctifs continuent de reposer sur des ingénieurs humains, l'IA n'intervenant qu'en amont pour accélérer la détection. L'éditeur tient aussi à couper court à une interprétation inverse de ces chiffres impressionnants : selon lui, ce déluge de correctifs ne traduit pas une dégradation de la sécurité de Windows, mais au contraire une meilleure capacité des équipes de défense à identifier et traiter les problèmes existants. Cette évolution s'inscrit dans un mouvement plus large de l'industrie, où l'IA devient un outil à double tranchant, aussi précieux pour les défenseurs qui cherchent à corriger les failles que pour des attaquants qui pourraient s'en servir pour les exploiter avant qu'elles ne soient corrigées.

UELes entreprises et administrations françaises utilisant Windows devront anticiper un volume accru de correctifs de sécurité à déployer chaque mois.

💬 Microsoft assume publiquement l'IA dans sa chasse aux failles, et 200 correctifs en un seul Patch Tuesday, ça change la donne pour toutes les DSI qui déploient Windows. Bonne nouvelle sur le papier, ça veut dire des trous détectés plus vite, mais ça veut aussi dire plus de charge de déploiement chaque mois pour les équipes. Retiens ça : quand l'IA accélère la détection côté défenseurs, elle raccourcit aussi la fenêtre de tir pour les attaquants qui scannent les mêmes correctifs.

SécuritéActu
1 source
Amazon présente son cadre pour des agents IA fiables à VB Transform 2026
2VentureBeat AI 

Amazon présente son cadre pour des agents IA fiables à VB Transform 2026

Amazon présentera lors de la conférence VB Transform 2026, les 14 et 15 juillet à Menlo Park (Californie), son cadre méthodologique pour concevoir des agents IA dignes de confiance en entreprise. Bryan Silverthorn, directeur du laboratoire de recherche AGI Autonomy chez Amazon, y animera une session intitulée "Closing the capability-reliability gap: Inside Amazon's framework for engineering trustworthy agents". Il y détaillera comment passer d'architectures mono-agent rudimentaires à des systèmes multi-outils capables de se corriger en cours d'exécution. La démarche d'Amazon repose sur quatre piliers : cohérence, robustesse, prévisibilité et sécurité, en remplacement des benchmarks EVAL traditionnels qui ne mesurent que des performances statiques à un instant donné. L'enjeu est considérable pour les décideurs IT, qui restent profondément méfiants vis-à-vis de l'autonomie accordée aux agents IA sur les systèmes d'entreprise. Selon une enquête VentureBeat Q2 2026 menée auprès de plus de 100 dirigeants technologiques seniors, seulement 4 % d'entre eux se disent à l'aise avec l'idée de s'appuyer uniquement sur les garde-fous intégrés aux modèles. 40 % citent l'accès non autorisé aux outils ou aux données comme principale inquiétude, et 27 % redoutent les attaques par injection de prompts. Amazon propose en réponse des environnements sandboxés où les agents soumettent leurs actions à validation humaine avant exécution, une approche particulièrement critique dans des secteurs sensibles comme la finance, où une erreur d'agent peut causer des dommages substantiels. Ce tournant vers la fiabilité plutôt que la seule performance brute intervient alors que l'industrie prend conscience des limites des scores EVAL, incapables de rendre compte du comportement des modèles face à la diversité des prompts, des environnements et des types de données en production. Amazon s'inscrit dans une tendance de fond : découpler les systèmes pour mieux les contrôler, plutôt que de supposer qu'un modèle peut être "bridé" après coup. VB Transform 2026 réunira également Manasi Joshi, directrice de l'intelligence des systèmes et du machine learning chez Waymo, qui abordera la question de l'IA sûre et efficace dans le monde physique. Ces deux sessions illustrent une préoccupation commune qui structure désormais le débat industriel : comment transformer des capacités impressionnantes en déploiements fiables, auditables, et acceptables pour les organisations qui en portent la responsabilité.

SécuritéActu
1 source
Amazon utilise des agents IA pour la détection de vulnérabilités à grande échelle
3Amazon Science 

Amazon utilise des agents IA pour la détection de vulnérabilités à grande échelle

En 2025, la base de données nationale des vulnérabilités américaine (NVD) a enregistré plus de 48 000 nouvelles failles de sécurité référencées (CVE), un volume rendu possible en grande partie par la prolifération des outils automatisés de détection. Face à cette explosion, Amazon Web Services a développé RuleForge, un système d'intelligence artificielle agentique conçu pour générer automatiquement des règles de détection à partir d'exemples de code d'exploitation de vulnérabilités. Déployé en production chez AWS, RuleForge affiche une productivité supérieure de 336 % à la création manuelle, tout en conservant le niveau de précision exigé pour des systèmes de sécurité industriels. Les règles produites sont au format JSON et alimentent directement MadPot, le système mondial de "honeypot" d'Amazon qui capture le comportement des attaquants, ainsi que Sonaris, le moteur interne de détection d'exploits suspects. Avant RuleForge, transformer une CVE en règle de détection opérationnelle était un processus entièrement manuel : un analyste téléchargeait le code de preuve de concept, étudiait le mécanisme d'attaque, rédigeait la logique de détection, la validait par itérations successives contre les journaux de trafic, puis soumettait le tout à une revue par un second ingénieur avant déploiement. Ce cycle, rigoureux mais lent, obligeait les équipes à prioriser strictement les vulnérabilités traitées, laissant potentiellement des failles critiques sans couverture. RuleForge comprime ce délai de façon drastique : le système ingère automatiquement le code d'exploitation public, attribue un score de priorité via une analyse de contenu croisée avec des sources de threat intelligence, puis génère en parallèle plusieurs règles candidates via un agent tournant sur AWS Fargate avec Amazon Bedrock. Chaque candidate est évaluée non pas par le modèle qui l'a produite, mais par un agent "juge" distinct, évitant ainsi l'auto-validation biaisée. Les humains restent dans la boucle pour l'approbation finale avant mise en production. Cette architecture reflète une tendance profonde dans la sécurité offensive et défensive : l'automatisation par IA ne remplace pas les experts, elle leur permet de travailler à une échelle autrement inaccessible. AWS anticipe une croissance continue du nombre de CVE à haute sévérité publiées, portée par les mêmes outils d'IA qui accélèrent la découverte de failles côté attaquants. RuleForge représente la réponse symétrique côté défense, en industrialisant la réactivité. L'approche modulaire, avec des agents spécialisés pour la génération, l'évaluation et le raffinement, plutôt qu'un seul modèle monolithique, s'inscrit dans la lignée des architectures multi-agents qui émergent comme standard pour les tâches complexes nécessitant fiabilité et auditabilité. D'autres grands acteurs du cloud font face aux mêmes défis, et la publication par Amazon des détails de RuleForge suggère une volonté de positionner cette approche comme référence sectorielle.

SécuritéActu
1 source
Pour traquer les bots IA de ses forums, Reddit a trouvé la solution parfaite : utiliser l’IA
4Le Big Data 

Pour traquer les bots IA de ses forums, Reddit a trouvé la solution parfaite : utiliser l’IA

Reddit a publié un rapport détaillant sa stratégie de lutte contre les bots alimentés par l'intelligence artificielle, et la solution retenue par la plateforme est pour le moins ironique : combattre l'IA par l'IA. Selon les chiffres communiqués par l'entreprise, environ 25 000 publications et commentaires jugés suspects auraient été détectés chaque jour durant le premier trimestre 2026. Sur cette même période, Reddit affirme avoir bloqué 23 millions de vues liées à du contenu de spam et supprimé près de 2 millions de votes considérés comme artificiels quotidiennement. La plateforme annonce comme résultat global une baisse de 20 % de l'exposition des utilisateurs aux contenus indésirables. Concrètement, ce sont des modèles de langage qui analysent en continu le comportement des comptes, parfois avant même la publication d'un premier message, pour repérer les signaux d'automatisation. Ces résultats ont une portée qui dépasse le seul cas de Reddit. Les plateformes communautaires sont confrontées depuis plusieurs années à une prolifération de faux comptes capables d'imiter des échanges humains, de manipuler des votes ou de simuler des mouvements de popularité autour d'un contenu. Une modération plus rapide et plus précise change directement l'expérience des utilisateurs, qui voient moins de contenus manipulés remonter dans leurs fils, et renforce la crédibilité des discussions et des classements de la plateforme, un enjeu central pour un site dont la valeur repose largement sur l'authenticité des échanges entre internautes. La capacité annoncée à sanctionner un compte ou un contenu suspect en moins de cinq secondes illustre aussi une automatisation poussée de la détection, avec la possibilité de demander à certains utilisateurs de prouver qu'ils sont humains. Cette initiative s'inscrit dans un contexte plus large où la multiplication des contenus générés par IA complique la tâche des plateformes sociales, obligées de s'appuyer sur des outils toujours plus sophistiqués pour distinguer l'activité humaine de l'activité automatisée. Reddit précise toutefois ne pas vouloir tout confier aux machines : entre juillet et décembre 2025, les modérateurs humains restaient responsables de plus de 52 % des suppressions de contenus, un signe que l'entreprise mise sur une approche hybride plutôt que sur une automatisation totale de la modération.

SécuritéActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic