Aller au contenu principal
LLMsLe Big Data · 2 min de lecture

Google lance trois nouveaux modèles Gemini… mais le plus attendu manque à l’appel

Résumé IASources croisées · 2Impact UE
Source originale ↗·
Egalement couvert par :01net

Google a dévoilé le 21 juillet 2026 trois nouveaux modèles de sa gamme Gemini, sans toutefois inclure la mise à jour tant attendue de Gemini 3.5 Pro. Les trois nouveautés sont Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, tous dotés d'une fenêtre de contexte d'un million de jetons et compatibles avec des entrées texte, image, vidéo et audio. Gemini 3.6 Flash, principal modèle de l'annonce, s'appuie sur les retours d'entreprises et de développeurs ayant utilisé Gemini 3.5 Flash. Il progresse nettement en programmation, avec un score de 49 % sur le benchmark DeepSWE contre 37 % pour son prédécesseur, et atteint 63,9 % sur MLE Bench contre 49,7 % auparavant. Ses capacités d'utilisation d'un ordinateur s'améliorent également, passant de 78,4 % à 83 % sur OSWorld-Verified, tandis que son score GDPval-AA v2 grimpe à 1 421 points contre 1 349. Il consomme pourtant jusqu'à 17 % de jetons en moins et nécessite moins d'étapes de raisonnement. Son prix est fixé à 1,50 dollar par million de jetons en entrée et 7,50 dollars en sortie. Gemini 3.5 Flash-Lite, positionné comme le modèle le plus économique de la gamme à 0,30 dollar par million de jetons en entrée et 2,50 dollars en sortie, est aussi le plus rapide avec 350 jetons produits par seconde selon Artificial Analysis.

Ces annonces confirment la stratégie de Google consistant à multiplier les déclinaisons de ses modèles pour couvrir un maximum de cas d'usage professionnels, de la génération de code au traitement de tâches longues, sans nécessairement se limiter à la puissance brute d'un modèle unique. La baisse des tarifs associée aux gains de performance vise directement les entreprises qui déploient des agents IA à grande échelle et cherchent à réduire leurs coûts d'inférence tout en maintenant une qualité de résultat élevée. Le renforcement de la sécurité de Gemini 3.6 Flash contre les usages malveillants liés à la cybercriminalité illustre par ailleurs la pression croissante exercée sur les fournisseurs de modèles pour limiter les risques de détournement, notamment via des techniques de jailbreak.

Cette annonce s'inscrit dans une course effrénée entre grands laboratoires d'IA, où chaque acteur multiplie les mises à jour incrémentales pour maintenir son avantage compétitif sur les benchmarks. Le fait que Gemini 3.5 Flash-Lite dépasse parfois Gemini 3 Flash, notamment sur SWE-Bench Pro (54,2 % contre 49,6 %) et OSWorld-Verified (74 % contre 65,1 %), montre à quel point les modèles dits "légers" gagnent en légitimité face aux versions plus lourdes. L'absence de Gemini 3.5 Pro dans cette vague laisse toutefois planer l'attente d'une annonce majeure à venir, Google réservant vraisemblablement ses avancées les plus significatives pour un lancement distinct.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1The Decoder 

Google lance trois nouveaux modèles Gemini Flash, mais son modèle phare 3.5 Pro reste toujours en entraînement

Google a présenté le 24 juillet 2026 trois nouveaux modèles de la famille Gemini Flash, dont Gemini 3.6 Flash, une version plus efficace qui consomme jusqu'à 65 % de jetons en moins que ses prédécesseurs pour un traitement équivalent. L'entreprise a également dévoilé un modèle spécialisé en cybersécurité, réservé aux gouvernements et à un cercle restreint de partenaires triés sur le volet. En revanche, le modèle phare tant attendu, Gemini 3.5 Pro, reste absent : Google indique qu'il est toujours en cours d'entraînement, sans date de sortie précisée. Ce décalage place Google dans une position délicate face à ses concurrents directs. OpenAI, Anthropic et plusieurs laboratoires chinois disposent déjà de modèles de pointe opérationnels, ce qui accentue la pression sur Google pour livrer rapidement son propre modèle de référence. Pour les entreprises et développeurs qui s'appuient sur l'écosystème Gemini, cela signifie devoir composer avec des modèles Flash plus légers et économes en ressources, mais sans accès à la puissance de calcul et aux capacités de raisonnement attendues d'un modèle "Pro" de dernière génération. L'accès restreint du modèle de cybersécurité aux acteurs gouvernementaux illustre par ailleurs la sensibilité croissante des usages de l'IA dans ce secteur. Cette annonce s'inscrit dans une course effrénée entre grands laboratoires d'IA, où chaque mois apporte son lot de nouveaux modèles capables de surpasser la concurrence sur les benchmarks. Google mise sur l'efficacité et la spécialisation avec ses modèles Flash pour maintenir sa présence sur le marché pendant que 3.5 Pro achève son entraînement. Reste à savoir combien de temps l'entreprise pourra tenir cette stratégie d'attente avant que ses rivaux ne consolident durablement leur avance sur les cas d'usage les plus exigeants.

LLMsOpinion
1 source
Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini
2The Decoder 

Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini

Lors de sa conférence développeurs Google I/O, tenue cette semaine, Google a dévoilé plusieurs annonces majeures dans le domaine de l'intelligence artificielle. Au programme : un nouveau modèle de langage baptisé Gemini 3.5 Flash, conçu pour allier rapidité et efficacité, un modèle multimodal nommé Gemini Omni capable de traiter simultanément texte, images, audio et vidéo, ainsi qu'un agent personnel cloud appelé Gemini Spark, pensé pour fonctionner en continu, vingt-quatre heures sur vingt-quatre. L'application Gemini bénéficie par ailleurs d'une refonte visuelle et fonctionnelle complète. L'introduction de Gemini Spark marque un tournant dans la vision de Google pour l'IA personnelle. Contrairement aux assistants classiques qui se contentent de répondre à des requêtes ponctuelles, un agent cloud permanent peut exécuter des tâches de façon autonome, anticiper des besoins, surveiller des données ou déclencher des actions sans intervention humaine. Pour les développeurs comme pour les utilisateurs grand public, cela ouvre la voie à une nouvelle catégorie d'assistants proactifs, toujours disponibles et potentiellement connectés à l'ensemble des services Google. Ces annonces s'inscrivent dans une course effrénée à l'IA agentique que se livrent Google, OpenAI et Microsoft depuis début 2025. Google cherche à reprendre l'initiative après avoir été perçu comme en retrait face aux avancées de GPT-4o et des agents d'OpenAI. Avec cette vague de lancements, l'entreprise signale sa volonté de positionner Gemini non plus comme un simple chatbot, mais comme une infrastructure d'IA omniprésente, ancrée dans le cloud et intégrée à l'ensemble de son écosystème.

UELes nouveaux modèles Gemini et l'agent cloud permanent seront accessibles aux développeurs et entreprises européens, accélérant l'adoption de l'IA agentique dans l'écosystème Google en Europe.

LLMsActu
1 source
Google met à jour Android Bench avec de nouveaux LLM, mais Gemini reste à la traîne
3Ars Technica AI 

Google met à jour Android Bench avec de nouveaux LLM, mais Gemini reste à la traîne

Google a mis à jour Android Bench, son benchmark dédié à l'évaluation des grands modèles de langage sur des tâches de développement Android, lancé en mars. La nouvelle version intègre huit modèles supplémentaires parmi les plus récents du marché : Claude Fable 5, Claude Sonnet 5 et Claude Opus 4.8 d'Anthropic, GLM 5.2, Kimi K2.7 Code, MiniMax M3, ainsi que Qwen 3.7 Plus et Qwen 3.7 Max. Le classement repose sur une suite de 100 tâches de développement Android et adopte désormais un nouveau cadre de test présenté comme plus simple à utiliser. Google a également ajouté de nouvelles métriques, notamment le coût et l'efficacité des modèles, en plus d'intégrer des modèles à poids ouverts, qui n'étaient pas couverts jusqu'ici. Ce type de benchmark répond à un besoin concret pour les développeurs Android : la génération de code par IA s'est imposée comme l'un des usages les plus populaires des LLM, mais tous les modèles ne se valent pas selon les tâches. Distinguer les suggestions réellement utiles des résultats approximatifs suppose de savoir quel outil choisir pour quel contexte. En publiant des résultats comparatifs sur le coût, l'efficacité et la qualité du code produit, Google donne aux équipes de développement des repères concrets pour arbitrer entre les différents modèles disponibles, plutôt que de se fier uniquement à la réputation générale d'un LLM. Cette mise à jour s'inscrit dans une compétition de plus en plus dense entre fournisseurs de modèles, où Anthropic, la Chine avec GLM, Kimi et Qwen, et d'autres acteurs multiplient les versions spécialisées pour le code. Google invite désormais les développeurs à exécuter eux-mêmes ces tests sur leurs propres projets et à transmettre leurs retours, dans l'idée de faire évoluer Android Bench de façon continue. Reste à voir comment les modèles propres à Google, notamment Gemini, se positionneront face à cette concurrence croissante dans les prochaines itérations du benchmark.

LLMsOutil
1 source
Google lance Gemini 3.5 Live Translate, un modèle audio voix-à-voix en temps réel couvrant plus de 70 langues
4MarkTechPost 

Google lance Gemini 3.5 Live Translate, un modèle audio voix-à-voix en temps réel couvrant plus de 70 langues

Google a lancé Gemini 3.5 Live Translate, un nouveau modèle audio capable de traduire la parole en temps réel dans plus de 70 langues. Disponible sous l'identifiant gemini-3.5-live-translate-preview, il fonctionne en mode speech-to-speech : de l'audio parlé entre, de l'audio traduit sort, avec une latence de quelques secondes seulement. Contrairement aux systèmes classiques qui attendent la fin d'une phrase pour commencer à traduire, ce modèle traite le flux audio en continu, au fil de la parole. Il préserve l'intonation, le rythme et la hauteur de voix du locuteur dans la version traduite. Le déploiement s'effectue sur trois surfaces simultanément : les développeurs y accèdent via une préversion publique dans la Gemini Live API et Google AI Studio, les entreprises via une préversion privée dans Google Meet à partir de ce mois-ci, et le grand public via l'application Google Traduction sur Android et iOS. Ce modèle représente une rupture technique significative pour tous les secteurs qui dépendent de la communication multilingue en direct. Lors d'appels professionnels, de réunions internationales, de cours en ligne ou de diffusions live, la barrière de la langue peut être levée sans infrastructure dédiée ni interprète humain. Des plateformes comme Agora, LiveKit, Pipecat et Fishjam intègrent déjà la Live API, ce qui réduit considérablement le travail d'intégration pour les développeurs. L'exemple concret le plus parlant vient de Grab, le géant asiatique du transport à la demande : la société teste activement le modèle pour les échanges entre chauffeurs et passagers au moment de la prise en charge, sachant que ses utilisateurs passent plus de 10 millions d'appels vocaux. Cette annonce s'inscrit dans la stratégie de Google visant à imposer sa suite Gemini comme infrastructure de référence pour l'IA temps réel. Techniquement, le modèle ne fonctionne qu'en entrée audio, sans prise en charge du texte, sans appel d'outils ni instructions système, ce qui le distingue radicalement des agents conversationnels classiques. La configuration s'effectue via un bloc translationConfig dans la Gemini Live API, avec un paramètre targetLanguageCode au format BCP-47 et une option echoTargetLanguage pour gérer les cas où le locuteur parle déjà la langue cible. Les formats audio sont fixes : entrée en PCM 16 bits à 16 kHz, sortie à 24 kHz. Ce choix de spécialisation radicale, au détriment de la flexibilité, témoigne d'une priorité claire donnée à la latence et à la fiabilité, deux critères décisifs pour les usages professionnels et grand public en conditions réelles.

UELa prise en charge de plus de 70 langues dont les principales langues européennes permet aux entreprises du marché unique d'intégrer la traduction temps réel dans Google Meet et via API sans infrastructure dédiée, réduisant les barrières linguistiques dans les communications professionnelles transfrontalières.

LLMsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic