Un patron IA licencie son premier employé, mais seulement après un rappel des règles par des humains
Le laboratoire Andon Labs a rapporté qu'un agent d'intelligence artificielle baptisé Luna, chargé de gérer un magasin à San Francisco, a licencié un employé humain, une première pour un système de ce type. L'IA n'a toutefois pris cette décision qu'après que des opérateurs humains lui ont explicitement rappelé ses propres règles de gestion, ce qui montre qu'elle n'a pas agi de manière totalement autonome. Andon Labs a ensuite rejoué ce même scénario avec sept modèles d'IA différents afin de comparer leurs comportements face à une décision de licenciement. Les modèles les plus performants ont recommandé le renvoi de façon plus systématique et cohérente, tandis que les modèles moins avancés ont montré davantage d'hésitation face à cette décision.
Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →
Cette expérience illustre un enjeu croissant à mesure que des entreprises testent des IA capables de gérer des équipes humaines, avec un pouvoir de décision allant jusqu'au licenciement. Le fait que l'IA ait eu besoin d'un rappel humain pour agir souligne les limites actuelles de l'autonomie de ces systèmes dans des décisions à fort impact social et économique pour les personnes concernées. À l'inverse, l'observation selon laquelle presque tous les modèles se sont montrés peu critiques lors de décisions d'embauche soulève des questions sur la fiabilité de ces IA lorsqu'il s'agit d'évaluer des candidats.
Ces tests s'inscrivent dans un mouvement plus large où des laboratoires comme Andon Labs explorent les capacités et les risques des agents IA placés à des postes de gestion. Alors que les entreprises technologiques cherchent à automatiser davantage de fonctions managériales, ces résultats mettent en lumière l'écart entre les capacités techniques des modèles et leur jugement dans des situations impliquant des conséquences humaines directes, un sujet appelé à prendre de l'ampleur à mesure que ces outils se généralisent.
Pas d'impact direct sur la France/UE