Google lance Gemini 3.8 Live pour concurrencer GPT-Live-1 d'OpenAI, a moindre cout
Google DeepMind a lancé Gemini 3.8 Live et sa variante Gemini 3.8 Live Extended Thinking, deux nouveaux modèles audio destinés aux développeurs. Ces modèles se placent en tête du classement speech-to-speech d'Artificial Analysis, qui évalue les performances des systèmes de conversation vocale par intelligence artificielle. Leur principal argument commercial reste toutefois le prix : Google facture 1,38 dollar par heure de conversation vocale, un tarif nettement inférieur à celui pratiqué par OpenAI pour son modèle concurrent GPT-Live-1. Les deux entreprises se positionnent ainsi directement l'une contre l'autre sur le segment des interfaces vocales génératives, un marché en pleine expansion pour les assistants conversationnels.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →
Cette annonce a une portée concrète pour les entreprises qui développent des applications vocales, des assistants clients ou des outils d'accessibilité reposant sur l'IA. Un coût d'exploitation réduit de manière significative change l'équation économique pour les développeurs qui doivent choisir entre plusieurs fournisseurs, en particulier pour les usages à fort volume comme les centres d'appels automatisés ou les compagnons vocaux grand public. Cependant, le prix ne fait pas tout : GPT-Live-1 d'OpenAI devrait conserver un avantage qualitatif grâce à sa capacité en duplex intégral, qui permet une conversation plus fluide où l'utilisateur et le modèle peuvent parler et s'interrompre simultanément, comme dans un échange humain naturel.
Cette rivalité s'inscrit dans une course plus large entre Google et OpenAI pour dominer le marché émergent des interfaces vocales par IA, considérées comme une prochaine étape majeure après les chatbots textuels. Chaque acteur cherche à combiner performance technique, mesurée par des classements indépendants comme celui d'Artificial Analysis, et compétitivité tarifaire pour attirer les développeurs tiers. La bataille se joue désormais autant sur la latence et le réalisme conversationnel que sur le coût par minute d'utilisation, un facteur déterminant pour l'adoption à grande échelle par les entreprises qui intègrent ces technologies dans leurs produits.
Les entreprises européennes développant des applications vocales pourraient réduire leurs couts d'exploitation en choisissant ce fournisseur, sans impact réglementaire direct.