Un journaliste de The Information a testé Muse, le nouvel agent IA personnel de Meta Platforms, et l'expérience a failli lui coûter 414 dollars. En voulant réserver deux nuits dans un hôtel Marriott à Santa Monica, il a laissé l'agent gérer le paiement via ses coordonnées bancaires, un enchaînement passant par Chase puis Stripe qui a manqué de tourner à la catastrophe. L'histoire rappelle que confier de l'argent réel à un agent IA reste une prise de risque bien concrète, malgré les promesses d'autonomie de Meta.
Sam Altman a par ailleurs écarté toute idée d'introduction en Bourse d'OpenAI en 2026, la qualifiant d'imprudente lors d'un entretien de 45 minutes accordé à Fortune, où il est aussi revenu sur le récent piratage de Hugging Face et sur l'hypothèse d'une auto-amélioration récursive des systèmes d'IA. Au même moment, Dario Amodei, le patron d'Anthropic, a appelé publiquement à des limites de vitesse sur le développement de l'IA, mettant en garde contre le risque qu'un système capable de s'améliorer lui-même échappe au contrôle humain, une sortie qui intervient juste avant ce qui pourrait devenir la plus grande introduction en Bourse de l'histoire. Deux dirigeants, deux calendriers différents, mais la même inquiétude affichée face à la vitesse à laquelle l'IA progresse.
GPT-6 Astra, le dernier modèle d'OpenAI, était justement au centre de deux annonces distinctes. D'un côté, OpenAI conseille désormais aux développeurs d'alléger leurs prompts: son employé Eric Provencher explique que des instructions trop longues et trop de garde-fous nuisent en réalité aux performances du modèle. De l'autre, un nouveau benchmark de robotique, StationeryBench, a révélé un progrès qualifié de "changement radical" en raisonnement spatial, même si GPT-6 Astra n'a réussi que 7 tâches sur 100 dans des tests de manipulation confiés à des robots à double bras. Entre un agent qui gère encore mal l'argent, des patrons qui réclament plus de prudence et un modèle qui progresse par à-coups sur le terrain physique, le message du jour est le même: l'IA avance vite, mais son autonomie reste largement à apprivoiser.