Aller au contenu principal
Présentation d'EVMbench
OutilsOpenAI Blog · 1 min de lecture

Présentation d'EVMbench

Source originale ↗·

OpenAI et Paradigm présentent EVMbench, un benchmark évaluant la capacité des agents d'IA à détecter, corriger et exploiter des vulnérabilités critiques dans les contrats intelligents. Ce test mesure l'efficacité des systèmes d'IA dans la gestion des failles de sécurité importantes dans ce domaine.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Présentation : migrer du code legacy en semaines, pas en années
1InfoQ AI 

Présentation : migrer du code legacy en semaines, pas en années

David Stein, ingénieur chez ServiceTitan, a présenté une approche radicalement nouvelle pour accélérer les migrations de code legacy à grande échelle grâce à l'intelligence artificielle. Sa méthode, baptisée le pattern « chaîne d'assemblage », permet de réduire des chantiers de refactorisation qui prenaient des années à quelques semaines seulement. Le principe repose sur la décomposition du code existant en tâches standardisées et répétables, que des agents LLM peuvent alors traiter en parallèle à une vitesse impossible pour une équipe humaine classique. L'impact pour les équipes d'ingénierie est considérable : là où une migration architecturale mobilisait des dizaines de développeurs pendant des mois, ce modèle industrialise le travail en éliminant les goulets d'étranglement humains. La clé du dispositif réside dans des boucles de validation programmatiquement strictes, conçues pour détecter et corriger les hallucinations des LLM avant qu'elles ne contaminent la base de code. Sans ce filet de sécurité, la parallélisation massive serait trop risquée pour être déployée en production. Cette présentation s'inscrit dans une tendance plus large : les grandes entreprises tech cherchent à transformer leur dette technique accumulée en levier de compétitivité plutôt qu'en handicap permanent. ServiceTitan, éditeur de logiciels de gestion pour les entreprises de services, fait face comme beaucoup à des systèmes vieillissants difficiles à moderniser sans interrompre l'activité. L'approche de Stein suggère que l'IA ne sert plus seulement à générer du nouveau code, mais devient un outil industriel de remédiation du passif technique existant.

OutilsOutil
1 source
Des agents en essaim : présentation d'une approche ludique et rentable
2InfoQ AI 

Des agents en essaim : présentation d'une approche ludique et rentable

Adrian Cockcroft, ancien architecte en chef d'Amazon Web Services et figure reconnue de l'ingénierie cloud, a présenté une conférence intitulée « Diriger un essaim d'agents pour le plaisir et le profit », dans laquelle il expose sa vision de ce qu'il appelle le développement « AI-native ». S'appuyant sur des expériences concrètes menées avec des outils comme Cursor et Claude Flow, il décrit une approche de niveau « directeur » : plutôt que d'écrire du code ligne par ligne, l'ingénieur orchestre des essaims d'agents autonomes qui exécutent les tâches en parallèle. Ses expérimentations couvrent notamment le BDD (développement piloté par le comportement), les serveurs MCP et le portage de code entre langages de programmation. Cette transition du cloud-native vers l'AI-native représente un changement de paradigme majeur pour l'industrie du logiciel. Elle implique que la valeur ajoutée de l'ingénieur se déplace de l'écriture du code vers la conception de plateformes capables de coordonner des agents IA. Pour les équipes de développement, cela signifie repenser les workflows, les outils de revue et la façon dont on mesure la productivité. Cockcroft est l'une des voix les plus influentes à théoriser ce basculement, après avoir contribué à populariser les microservices et l'architecture cloud à grande échelle chez Netflix puis AWS. L'émergence d'outils comme Claude Flow ou les serveurs MCP d'Anthropic crée l'infrastructure nécessaire à cette orchestration multi-agents. La question qui s'ouvre désormais est de savoir quelles compétences humaines resteront irremplaçables dans un pipeline où les agents gèrent l'essentiel de l'exécution technique.

OutilsOutil
1 source
Présentation de GPT-5.4
3OpenAI Blog 

Présentation de GPT-5.4

OpenAI a présenté GPT-5.4, un modèle de pointe optimisé pour le travail professionnel, doté de capacités avancées en programmation, utilisation des ordinateurs, recherche d'outils et un contexte de 1 million de tokens. Ce modèle combine efficacité et performance pour des tâches complexes.

LLMsOutil
1 source
Google Gemini : créer des plans de présentation en quelques secondes
4The Information AI 

Google Gemini : créer des plans de présentation en quelques secondes

Google a intégré dans Gemini une fonctionnalité qui permet aux dirigeants d'entreprise de générer en quelques secondes des plans de présentation structurés, là où les équipes consacraient auparavant des jours entiers à cette tâche. Le processus repose sur quatre étapes : rassembler ses idées brutes en cinq minutes de brainstorming libre, les charger dans un notebook Gemini aux côtés de documents existants (rapports trimestriels, guidelines de marque, présentations passées), formuler un prompt en langage naturel ou via Gemini Live (mode vocal sur mobile), puis itérer par conversation pour affiner le résultat. L'outil peut ensuite produire une décomposition slide par slide ou un tableau structuré prêt à transmettre à l'équipe, et même démarrer la présentation directement via la fonction Canvas. L'enjeu est significatif pour les organisations qui consacrent des ressources considérables à préparer des présentations stratégiques. Google illustre le cas d'un CEO de SaaS préparant un keynote pour le lancement d'un produit IA majeur devant des clients enterprise : au lieu de plusieurs réunions de cadrage, de longues chaînes d'e-mails et de cycles de relecture, un plan de haut niveau peut être posé en quelques minutes, donnant à l'équipe un fil directeur immédiat. La capacité de Gemini à ingérer de grands volumes de documents comme contexte d'un prompt permet de personnaliser la sortie bien au-delà d'un simple squelette générique. Pour les entreprises dont les présentations peuvent conditionner des décisions commerciales majeures, le gain en temps de coordination et en itérations internes est potentiellement très élevé. Cette annonce s'inscrit dans la bataille que se livrent Google, Microsoft et OpenAI pour ancrer leurs assistants IA dans les flux de travail professionnels quotidiens. Microsoft a poussé Copilot dans PowerPoint et Word ; OpenAI a développé des capacités de génération de documents structurés dans ChatGPT. Google répond en capitalisant sur l'intégration native de Gemini dans son écosystème Workspace, avec des notebooks qui servent de mémoire persistante entre les sessions. La fonctionnalité de prompt vocal via Gemini Live vise à réduire encore la friction, en permettant de dicter ses instructions comme on le ferait avec un collaborateur. La prochaine étape logique serait une intégration encore plus profonde avec Google Slides pour générer directement des decks complets, une direction que Google semble clairement préparer avec la fonction Canvas déjà disponible.

UELa fonctionnalité est intégrée à Google Workspace utilisé par des millions d'entreprises françaises et européennes, ce qui peut accélérer l'adoption de l'IA générative dans les processus de travail quotidiens.

💬 C'est pas la vitesse qui change le jeu, c'est le contexte. Pouvoir charger ses anciens decks, ses rapports Q, ses guidelines de marque, et obtenir un plan qui sonne vraiment comme ta boîte plutôt qu'un squelette sorti de nulle part, c'est ce que les autres n'ont pas encore bien résolu. Bon, faut que Canvas tienne ses promesses ensuite.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic