Aller au contenu principal
RechercheAI News · 2 min de lecture

Stanford : le modèle IA Evo 2 génère des phages contre E. coli

Source originale ↗·

Des chercheurs de l'université Stanford ont utilisé Evo 2, un modèle d'intelligence artificielle génératif conçu pour produire des séquences d'ADN, pour créer près de 300 bactériophages capables de cibler la bactérie Escherichia coli. Après des tests en laboratoire, l'équipe a retenu 16 phages présentant une activité antibactérienne particulièrement efficace. Les travaux se concentrent sur le bactériophage ΦX174, dont le génome compte moins de 6 000 paires de bases, contre environ 3 milliards pour le génome humain. Le modèle Evo 2 a été créé par Brian Hie, professeur assistant de génie chimique et titulaire de la chaire Dieter Schwarz Foundation Stanford Data Science, tandis que l'étudiant en doctorat de bio-ingénierie Samuel King a dirigé la partie expérimentale. Les chercheurs ont demandé au modèle de générer un génome complet de ΦX174 en une seule passe, de gauche à droite, sans intervention supplémentaire, ce qui a produit plusieurs milliers de génomes candidats. King a ensuite développé un cadre informatique pour réduire ce nombre avant la synthèse chimique, en évaluant les candidats selon des critères tirés de ΦX174 et de phages apparentés, avant de les tester en laboratoire.

Cette avancée illustre la capacité d'une IA générative à concevoir des génomes viraux entiers et fonctionnels, et non plus seulement à suggérer des modifications ponctuelles sur de l'ADN existant. Selon Hie, certains phages proposés par Evo 2 ont même montré une meilleure capacité de survie que la version naturelle de ΦX174 lors des essais. L'enjeu principal porte sur la résistance bactérienne: un cocktail composé des 16 phages sélectionnés a rapidement neutralisé des souches d'E. coli devenues résistantes au ΦX174 naturel, alors qu'un traitement à phage unique laisse aux bactéries une voie d'échappement. Hie souligne qu'il serait beaucoup plus difficile pour une bactérie de développer une résistance simultanée à plusieurs phages génétiquement distincts. Cette approche pourrait ouvrir la voie à de nouveaux traitements contre des infections aujourd'hui difficiles à soigner, comme le staphylocoque doré résistant à la méticilline (SARM) ou Pseudomonas aeruginosa, cité par Stanford comme l'une des principales causes d'infections résistantes contractées à l'hôpital.

Le projet s'inscrit dans un contexte plus large de recherche sur les usages biomédicaux de l'IA générative, alors que la résistance aux antibiotiques constitue une préoccupation sanitaire mondiale croissante. Hie a choisi de publier Evo 2 en open source, permettant à d'autres équipes de télécharger le modèle pour concevoir leurs propres génomes. Ce choix a toutefois suscité des discussions sur les risques de sécurité, Stanford reconnaissant elle-même que ce type d'outil pourrait potentiellement être détourné par des acteurs malveillants. Reste que la démonstration confirme que la synthèse chimique et les essais en laboratoire demeurent des étapes indispensables pour valider les propositions de l'IA, qui ne remplace donc pas encore entièrement le travail expérimental mais en accélère considérablement le rythme.

Impact France/UE

Le modèle Evo 2 étant publié en open source, des laboratoires de recherche européens pourraient l'utiliser pour développer leurs propres traitements contre la résistance aux antibiotiques, un enjeu de santé publique majeur en France et dans l'UE.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Comment les modèles ouverts stimulent la recherche en IA
1NVIDIA AI Blog 

Comment les modèles ouverts stimulent la recherche en IA

À l'occasion de l'ICML 2026, l'une des plus grandes conférences mondiales sur le machine learning, les statistiques des papiers acceptés révèlent à quel point les modèles et infrastructures ouverts sont devenus centraux dans la recherche en intelligence artificielle. NVIDIA compte à lui seul 74 papiers acceptés cette année. Environ 2 000 articles retenus citent l'utilisation de GPU NVIDIA, et 145 s'appuient spécifiquement sur Nemotron, la famille de modèles et jeux de données ouverts de l'entreprise, comme fondation de leurs travaux. Des centaines d'autres recherches mobilisent Cosmos, Isaac GR00T ou BioNeMo, couvrant l'IA physique, la robotique, les véhicules autonomes et la recherche biomédicale. Parmi les thèmes dominants figurent la génération vidéo, l'apprentissage par renforcement appliqué aux grands modèles de langage, l'entraînement d'agents et l'inférence, mais de nouveaux axes émergent nettement, notamment les modèles de monde pour la robotique. Le projet DreamDojo illustre cette tendance : construit sur Cosmos, il apprend le comportement du monde physique à partir de vidéos humaines afin de prédire comment un robot réagirait dans des environnements jamais rencontrés à l'entraînement, permettant d'évaluer des politiques de décision et de piloter un robot virtuel sans les coûts et risques d'un déploiement réel. Cette montée en puissance des modèles ouverts change concrètement la manière dont la science de l'IA progresse. Plutôt que de partir de zéro, les laboratoires académiques et industriels s'appuient sur des poids ouverts à évaluer, des jeux de données ouverts pour entraîner leurs propres modèles, et des recettes ouvertes couvrant le raisonnement, l'usage d'outils, la sécurité et l'inférence efficace. En sciences de la vie, les modèles ouverts BioNeMo ont permis des avancées comme FLIP2, un nouveau benchmark public pour évaluer la capacité de l'IA à prédire l'effet des mutations sur les protéines, ou KERMT, un modèle dédié aux propriétés moléculaires utiles à la découverte de médicaments. La génération de données synthétiques s'impose également comme un axe majeur, reflétant un besoin croissant d'entraîner des modèles à grande échelle sans dépendre uniquement de données annotées par des humains, un chantier soutenu par les outils NeMo Curator. Cette dynamique dépasse largement les laboratoires de NVIDIA. Basecamp Research a développé EDEN, un modèle de fondation pour l'ADN qui aide à interpréter et concevoir des séquences génétiques. Le groupe pharmaceutique Merck & Co. utilise KERMT pour prédire le comportement de molécules candidates à un traitement, notamment leur efficacité et leur sécurité potentielles. Le laboratoire japonais Sakana AI, présent à la conférence, a bâti ses modèles Fugu et Fugu-Ultra directement sur Nemotron 3 Ultra pour automatiser une partie de la recherche en IA, tandis que la startup KiloCode a intégré Nemotron dans son architecture de routage de code, revendiquant une réduction des coûts en tokens pouvant atteindre 90 %. Ces exemples illustrent comment l'ouverture des modèles et des infrastructures accélère l'innovation bien au-delà du seul écosystème de leur créateur, en abaissant la barrière d'entrée pour des équipes de recherche et des entreprises de toutes tailles.

UELes laboratoires de recherche académiques européens bénéficient indirectement de l'accès a ces modèles et jeux de données ouverts pour leurs propres travaux.

💬 Les chiffres parlent tout seuls : 2000 papiers ICML citent du GPU NVIDIA, 145 s'appuient sur Nemotron. On est loin du open source comme argument marketing, c'est devenu l'infrastructure de base de la recherche en IA. Ce qui me frappe, c'est que ça abaisse vraiment la barrière d'entrée : un labo japonais comme Sakana ou une startup comme KiloCode construisent dessus sans les moyens d'un géant. Reste à voir si NVIDIA garde cette ouverture quand la position dominante sera encore plus verrouillée.

RecherchePaper
1 source
Les grands modèles de langage comprennent-ils vraiment le contexte ?
2Apple Machine Learning 

Les grands modèles de langage comprennent-ils vraiment le contexte ?

Une équipe de chercheurs a publié un nouveau benchmark destiné à évaluer la capacité des grands modèles de langage (LLMs) à comprendre le contexte dans les textes en langage naturel. Ce travail, qui s'appuie sur l'adaptation de jeux de données existants, propose quatre tâches distinctes réparties sur neuf datasets, spécifiquement conçus pour tester les modèles génératifs plutôt que les architectures discriminatives traditionnelles. C'est l'une des premières initiatives à formaliser l'évaluation de la compréhension contextuelle comme discipline à part entière dans le domaine du traitement automatique du langage. La compréhension du contexte est fondamentale dans la communication humaine : un même mot ou une même phrase peut signifier des choses très différentes selon la situation, le registre ou les informations implicites partagées entre les interlocuteurs. Or, si les LLMs comme GPT-4 ou Claude sont évalués sur de nombreuses capacités linguistiques, cette dimension contextuelle restait jusqu'ici peu explorée de façon systématique. Ce benchmark comble ce manque et permettra aux équipes de recherche de mieux identifier les limites réelles de ces modèles face à des situations ambiguës ou implicites, ce qui a des implications directes pour les applications de chat, de résumé automatique ou d'assistance à la rédaction. La question de ce que "comprennent" réellement les LLMs anime le débat scientifique depuis l'émergence des architectures Transformer. Beaucoup de benchmarks actuels mesurent des performances sur des tâches bien délimitées, sans capturer la subtilité de l'interprétation contextuelle. En proposant un cadre d'évaluation dédié, ce travail pourrait influencer la façon dont les prochaines générations de modèles sont entraînées et comparées, en poussant l'industrie à intégrer la robustesse contextuelle comme critère de qualité à part entière.

RecherchePaper
1 source
3The Decoder 

Stanford et l'Arc Institute utilisent l'IA pour créer des virus qui tuent des bactéries en laboratoire

Des chercheurs de l'université Stanford et de l'Arc Institute, deux institutions basées en Californie, ont utilisé l'intelligence artificielle pour concevoir des virus entièrement nouveaux, capables de tuer des bactéries lors de tests menés en laboratoire. Selon un rapport publié par MIT Technology Review, il s'agit de la première conception générative de génomes complets réalisée par une IA. Ces virus sont des bactériophages, des organismes qui infectent spécifiquement des bactéries sans s'attaquer aux cellules humaines. L'équipe a généré ces génomes de A à Z grâce à des modèles d'IA, avant de les synthétiser et de vérifier en conditions réelles que les virus obtenus fonctionnaient bien comme prévu, en éliminant leurs bactéries cibles. Cette avancée est significative parce qu'elle démontre que l'IA peut désormais produire des organismes fonctionnels complets, et non plus seulement prédire des structures moléculaires isolées comme une protéine. Les bactériophages conçus sur mesure suscitent un intérêt croissant en médecine, notamment pour lutter contre les bactéries résistantes aux antibiotiques, un problème de santé publique majeur. Mais la capacité à générer des virus fonctionnels par IA soulève aussi des questions de biosécurité, puisque les mêmes outils pourraient théoriquement être détournés pour concevoir des agents pathogènes dangereux. Ce résultat s'inscrit dans une vague plus large d'applications de l'IA à la biologie, après les percées de modèles comme AlphaFold dans la prédiction de structures protéiques. L'Arc Institute, organisation de recherche à but non lucratif fondée pour accélérer la biologie fondamentale, développe activement des modèles génératifs appliqués au vivant. Les chercheurs présentent ce travail comme une étape précoce vers la conception de formes de vie entières par IA, ouvrant la voie à des usages thérapeutiques tout en appelant à un encadrement prudent de ces technologies émergentes.

💬 Bactériophage conçu par IA de A à Z, testé en labo, qui bute bien la bactérie visée : c'est la première fois qu'un modèle génère un organisme fonctionnel complet, pas juste une structure protéique isolée comme AlphaFold. Sur le papier c'est une piste sérieuse contre l'antibiorésistance, mais la même techno qui dessine un virus pour tuer une bactérie peut en dessiner un autre pour un tout autre usage, et ça personne n'a de garde-fou solide pour l'instant. Le vrai test, c'est de voir qui encadre ces outils avant qu'ils tournent hors des labos californiens.

RecherchePaper
1 source
DeLM de Stanford réduit de 50 % les coûts des tâches multi-agents, sans orchestrateur central
4VentureBeat AI 

DeLM de Stanford réduit de 50 % les coûts des tâches multi-agents, sans orchestrateur central

Des chercheurs de Stanford ont publié un article de recherche présentant DeLM (Decentralized Language Model), un nouveau cadre pour les systèmes multi-agents qui abandonne le modèle centralisé dominant dans les frameworks d'IA actuels. Développé par Yuzhen Mao et Azalia Mirhoseini, DeLM remplace l'agent orchestrateur central par une architecture décentralisée reposant sur une base de connaissances partagée et une file d'attente de tâches. Concrètement, les agents travaillent en parallèle, lisent directement les résultats vérifiés de leurs pairs sous forme de "gists" (résumés compacts), et sélectionnent eux-mêmes les sous-tâches disponibles dans la file. Aucun agent principal ne collecte, filtre ou redistribue les informations. Selon les auteurs, cette approche réduit les coûts d'inférence de 50 % par rapport aux architectures centralisées classiques. Cette réduction de coût n'est pas un simple gain marginal : elle remet en question un postulat fondamental sur lequel reposent la plupart des frameworks multi-agents existants comme LangChain, AutoGen ou CrewAI. Dans les systèmes traditionnels, l'orchestrateur central devient rapidement un goulot d'étranglement lorsque le nombre de sous-tâches augmente. Il doit recevoir tous les rapports des sous-agents, décider quoi fusionner, quoi ignorer, puis redistribuer le contexte filtré, risquant à chaque étape de "diluer, omettre ou déformer" des informations utiles. Ce va-et-vient ralentit la coordination et contraint l'ensemble du système aux capacités d'un seul agent surchargé. DeLM contourne ce problème en permettant aux agents de construire directement sur le travail vérifié de leurs pairs, d'éviter les échecs déjà documentés et de ne récupérer les preuves détaillées que lorsqu'ils en ont besoin. L'essor des systèmes multi-agents en IA reflète une tendance de fond : face aux limites des modèles de langage individuels sur des tâches complexes et longues, l'industrie mise sur la décomposition parallèle du travail. Mais cette parallélisation a un coût en latence et en tokens que les équipes d'ingénierie peinent à contenir. Les travaux de Mao et Mirhoseini s'inscrivent dans une réflexion plus large sur l'architecture optimale pour des raisonnements à longue portée, notamment dans des scénarios de recherche d'information ou de résolution de problèmes multi-étapes. DeLM introduit également un mécanisme de vérification des gists avant leur partage : seuls les résultats validés entrent dans le contexte commun, limitant la propagation d'erreurs. Si ces résultats se confirment dans des benchmarks plus larges et des environnements de production, DeLM pourrait influencer la prochaine génération de frameworks agentiques, à un moment où les coûts d'inférence restent l'un des principaux freins au déploiement à grande échelle des systèmes d'IA autonomes.

RecherchePaper
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic