Aller au contenu principal
LLMsLe Big Data · 2 min de lecture

Google tease déjà Gemini 4 : son entraînement s’annonce le plus ambitieux à ce jour

Résumé IASources croisées · 2Impact UE
Source originale ↗·
Egalement couvert par :Frandroid

Google Gemini 4 : son entraînement s'annonce le plus ambitieux à ce jour

Google a discrètement révélé les premiers préparatifs de Gemini 4, la prochaine génération majeure de son intelligence artificielle. L'information est passée presque inaperçue, glissée dans l'annonce officielle de trois nouveaux modèles Gemini le 21 juillet 2026. Google y affirme avoir lancé son « programme d'entraînement préliminaire le plus ambitieux à ce jour » dans le cadre du projet Gemini 4. Logan Kilpatrick, Senior Product Manager chez Google DeepMind, a confirmé la nouvelle sur X le même jour, se disant enthousiaste face aux premiers résultats de cette phase de pré-entraînement (pre-training), l'étape durant laquelle le modèle est exposé à d'immenses volumes de données textuelles, visuelles et autres pour apprendre les relations entre elles. Google reste toutefois très avare en détails : aucune date de sortie, aucune caractéristique technique, aucun indice sur les nouvelles fonctionnalités n'a été communiqué. Impossible donc, à ce stade, de savoir ce que ce quatrième modèle apportera concrètement par rapport à ses prédécesseurs.

Cette annonce, minimale en apparence, envoie un signal fort à l'écosystème de l'intelligence artificielle. En affirmant mobiliser davantage de ressources que pour les générations précédentes sans préciser ni la taille des données ni la puissance de calcul engagée, Google cherche avant tout à démontrer sa capacité à maintenir la cadence face à une concurrence de plus en plus âpre, notamment OpenAI et Anthropic. Pour les développeurs et les entreprises qui construisent déjà leurs produits autour de l'API Gemini, ce type de communication anticipée sert de repère stratégique : il indique que l'investissement dans l'écosystème Google reste pertinent sur le long terme, même si les gains de performance concrets restent encore impossibles à évaluer. Pour les utilisateurs, la promesse reste pour l'instant abstraite, aucune fonctionnalité ni amélioration tangible n'ayant été précisée.

Ce qui interpelle le plus les observateurs, c'est le calendrier retenu par Google. L'entreprise évoque déjà Gemini 4 alors que Gemini 3.5 Pro, pourtant très attendu par la communauté, n'a toujours pas été déployé publiquement. Cette précipitation apparente illustre la pression constante qui pèse sur les grands laboratoires d'IA, contraints d'entretenir en permanence l'attention du marché sur leurs futurs modèles, parfois avant même d'avoir livré les précédents. Le pré-entraînement n'est qu'une étape parmi d'autres dans le développement d'un grand modèle de langage, suivie par l'affinage, l'alignement et les tests de sécurité, autant de phases qui peuvent encore prendre plusieurs mois. Reste à savoir si Google parviendra à combler l'écart entre ses annonces et ses livraisons effectives, dans un secteur où la course aux superlatifs technique se heurte de plus en plus souvent aux délais réels de mise sur le marché.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1The Decoder 

Google lance trois nouveaux modèles Gemini Flash, mais son modèle phare 3.5 Pro reste toujours en entraînement

Google a présenté le 24 juillet 2026 trois nouveaux modèles de la famille Gemini Flash, dont Gemini 3.6 Flash, une version plus efficace qui consomme jusqu'à 65 % de jetons en moins que ses prédécesseurs pour un traitement équivalent. L'entreprise a également dévoilé un modèle spécialisé en cybersécurité, réservé aux gouvernements et à un cercle restreint de partenaires triés sur le volet. En revanche, le modèle phare tant attendu, Gemini 3.5 Pro, reste absent : Google indique qu'il est toujours en cours d'entraînement, sans date de sortie précisée. Ce décalage place Google dans une position délicate face à ses concurrents directs. OpenAI, Anthropic et plusieurs laboratoires chinois disposent déjà de modèles de pointe opérationnels, ce qui accentue la pression sur Google pour livrer rapidement son propre modèle de référence. Pour les entreprises et développeurs qui s'appuient sur l'écosystème Gemini, cela signifie devoir composer avec des modèles Flash plus légers et économes en ressources, mais sans accès à la puissance de calcul et aux capacités de raisonnement attendues d'un modèle "Pro" de dernière génération. L'accès restreint du modèle de cybersécurité aux acteurs gouvernementaux illustre par ailleurs la sensibilité croissante des usages de l'IA dans ce secteur. Cette annonce s'inscrit dans une course effrénée entre grands laboratoires d'IA, où chaque mois apporte son lot de nouveaux modèles capables de surpasser la concurrence sur les benchmarks. Google mise sur l'efficacité et la spécialisation avec ses modèles Flash pour maintenir sa présence sur le marché pendant que 3.5 Pro achève son entraînement. Reste à savoir combien de temps l'entreprise pourra tenir cette stratégie d'attente avant que ses rivaux ne consolident durablement leur avance sur les cas d'usage les plus exigeants.

LLMsOpinion
1 source
2Ars Technica AI 

Google annonce Gemini 3.6 Flash et une IA de cybersécurité, teaser 3.5 Pro et Gemini 4

Google a dévoilé aujourd'hui trois nouveaux modèles d'intelligence artificielle, dont sa toute première version de Gemini conçue spécifiquement pour la cybersécurité. Cette annonce intervient quelques mois après la présentation de Gemini 3.5 Flash lors de la conférence I/O en mai, qui avait alors été la vedette de l'événement. Fait notable, aucun des trois nouveaux modèles n'est le très attendu Gemini 3.5 Pro, dont le lancement était pourtant prévu en juin et qui reste donc retardé. Gemini 3.5 Flash, à peine sorti, a déjà été abandonné et remplacé par Gemini 3.6 Flash, désormais disponible pour les développeurs et les utilisateurs. Google avance les arguments habituels pour ce nouveau modèle : des capacités légèrement supérieures, de meilleures performances en génération de code et des fonctionnalités multimodales avancées. Cette mise à jour rapide n'est pas anodine pour l'industrie. Google indique explicitement que les changements apportés à 3.6 Flash répondent aux retours des utilisateurs sur la version 3.5, qui n'avait globalement pas tenu ses promesses en matière de génération de code, un critère pourtant central pour les développeurs professionnels. Pour les entreprises qui intègrent ces modèles dans leurs outils, cela signifie une instabilité relative de l'offre Gemini et la nécessité de réadapter régulièrement leurs intégrations techniques. Le lancement d'un modèle dédié à la cybersécurité marque par ailleurs une diversification stratégique, Google cherchant à s'imposer sur un segment où la demande explose face à la multiplication des menaces assistées par IA. Ce remaniement rapide s'inscrit dans un contexte où les entreprises technologiques, Google en tête, sont soumises à une pression croissante sur les coûts liés aux tokens d'IA. Cette focalisation sur l'efficacité pourrait expliquer pourquoi Gemini 3.5 Flash n'a pas répondu aux attentes en codage, les optimisations de coûts ayant potentiellement pesé sur les performances. Reste à savoir quand Gemini 3.5 Pro verra finalement le jour, et Google laisse déjà entrevoir l'arrivée future de Gemini 4, signe d'une cadence de développement de plus en plus soutenue face à la concurrence d'OpenAI et d'Anthropic.

LLMsActu
1 source
Google annonce Gemini 3.5 Live Translate pour la traduction vocale en temps réel
3Ars Technica AI 

Google annonce Gemini 3.5 Live Translate pour la traduction vocale en temps réel

Google a annoncé Gemini 3.5 Live Translate, un nouveau modèle d'intelligence artificielle dédié à la traduction vocale instantanée, disponible dans plus de 70 langues. Ce modèle speech-to-speech fait partie de la famille Gemini 3.5 lancée lors de Google I/O, dont seule la version Flash avait jusqu'ici été déployée. La version Live Translate se distingue par une latence très faible, capable de suivre une conversation naturelle avec seulement quelques secondes de décalage, tout en reproduisant l'intonation, le rythme et la tonalité de la voix d'origine plutôt qu'une synthèse vocale générique. L'impact est significatif pour quiconque communique régulièrement dans des langues différentes, que ce soit dans un cadre professionnel, lors de voyages ou dans des contextes médicaux ou juridiques. En s'affranchissant de la nécessité d'avoir un téléphone Pixel ou des écouteurs spécifiques, Google ouvre cette capacité à un public beaucoup plus large. La fidélité vocale, qui préserve les caractéristiques personnelles de la voix du locuteur, représente un saut qualitatif par rapport aux solutions robotiques actuelles, rendant les échanges traduits plus naturels et plus dignes de confiance. Google travaille sur la traduction en temps réel depuis plusieurs années, avec des démonstrations publiques récurrentes lors de ses événements annuels, mais les contraintes matérielles en limitaient l'accès. L'an dernier, la traduction en direct avait été étendue à l'application Google Translate, mais Gemini 3.5 Live Translate marque une nouvelle étape en intégrant cette capacité directement dans un modèle de la série 3.5. Une version Pro de Gemini 3.5 est attendue dans les prochaines semaines, ce qui laisse entrevoir des performances encore supérieures. La course à la traduction universelle s'intensifie, avec des concurrents comme Meta et Microsoft qui investissent également dans ce domaine, faisant de la barrière des langues l'un des prochains grands défis résolus par l'IA.

UELa disponibilité de Gemini 3.5 Live Translate dans plus de 70 langues dont le français facilite la communication multilingue pour les professionnels et entreprises européens sans contrainte matérielle.

💬 C'est le genre de démo qu'on voit à Google I/O depuis quatre ans, sauf que là deux trucs changent vraiment : plus besoin de Pixel ni d'écouteurs spécifiques, et le modèle garde l'intonation et le rythme de la voix d'origine. Ce deuxième point, c'est ce qui rend ça utilisable pour de vrai dans un contexte médical ou légal, pas juste impressionnant en keynote. Reste à voir sur les accents difficiles et le bruit ambiant, mais pour la première fois je prends cette démo au sérieux.

LLMsActu
1 source
Gemini 3.1 Flash Live est le modèle vocal IA le plus naturel de Google à ce jour
4The Decoder 

Gemini 3.1 Flash Live est le modèle vocal IA le plus naturel de Google à ce jour

Google a dévoilé Gemini 3.1 Flash Live, son nouveau modèle vocal conçu pour des conversations en temps réel plus naturelles et plus fluides. Annoncé en mars 2026, ce modèle s'inscrit dans la gamme Flash, orientée vers la rapidité et l'efficacité. Les développeurs disposent d'un curseur permettant d'arbitrer entre qualité vocale et vitesse de réponse selon les besoins de leur application. La tarification reste alignée sur celle de Gemini 2.5, sans surcoût pour cette nouvelle génération. Ce lancement représente une avancée notable dans la course à la voix conversationnelle naturelle. Pour les développeurs d'assistants vocaux, d'applications de service client ou d'interfaces mains libres, disposer d'un modèle à la fois rapide et naturel à coût constant constitue un argument concret. La fluidité perçue de l'IA vocale est aujourd'hui un facteur décisif dans l'adoption par le grand public. Google intensifie ainsi la compétition face à OpenAI et ses modèles vocaux en temps réel, intégrés à ChatGPT, ainsi qu'à d'autres acteurs comme ElevenLabs. La stratégie Flash — modèles légers, rapides, peu coûteux — s'impose comme une approche clé pour démocratiser l'IA dans des usages à fort volume. Les prochaines versions pourraient continuer à affiner ce compromis vitesse/qualité, un équilibre qui deviendra central dans les interfaces conversationnelles de demain.

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic