Aller au contenu principal
Infrastructure · Actu ·

Google prépare lui aussi une puce IA pour faire tourner Gemini bien plus efficacement

Google développe une nouvelle puce IA en interne, baptisée « Frozen v2 », spécialement conçue pour faire tourner ses modèles Gemini, selon un rapport de The Information publié le 20 juillet 2026. Ce processeur pour serveurs viendrait compléter, et non remplacer, les TPU déjà utilisés par l'entreprise. Son originalité tiendrait à l'intégration directe de certains éléments de l'architecture de Gemini dans le matériel lui-même, réduisant ainsi la dépendance du modèle aux seuls logiciels. D'après les estimations internes citées dans le rapport, cette puce pourrait générer entre six et dix fois plus de tokens pour une même consommation d'énergie que les TPU les plus récents de Google. Un porte-parole de Google Cloud a confirmé que les équipes travaillaient à concevoir conjointement du matériel et des logiciels pour obtenir des systèmes « hautement optimisés », sans toutefois valider les détails précis du projet. Le déploiement de Frozen v2 ne serait pas attendu avant 2028, les ingénieurs devant encore trancher sur la conception finale et sur la part du modèle directement gravée dans le silicium.

2 min de lecturePertinence 36

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de Le Big Data. Lire l'article original →

Cette initiative répond à une pression bien concrète sur les infrastructures de Google. La demande en puissance de calcul pour faire tourner Gemini serait telle qu'elle aurait déjà provoqué des tensions internes, poussant Google Cloud à refuser certains contrats avec des clients externes faute de ressources disponibles. Une puce plus efficace permettrait de traiter davantage de requêtes sans augmenter la consommation énergétique ni multiplier les centres de données, un enjeu de plus en plus critique à mesure que les modèles d'IA generatifs gagnent en taille et en gourmandise. Pour les utilisateurs de Gemini comme pour les clients de Google Cloud, cela pourrait se traduire par une meilleure disponibilité du service et, potentiellement, des coûts d'exploitation réduits à terme.

Cette course au matériel sur mesure dépasse largement le seul cas de Google. Nvidia domine aujourd'hui le marché des puces IA, mais plusieurs géants technologiques cherchent à réduire leur dépendance à ce fournisseur unique en développant leurs propres processeurs adaptés à leurs modèles. Amazon a ses puces Trainium et Inferentia, Microsoft son Maia, et Meta développe également ses propres accélérateurs. En misant sur une architecture pensée main dans la main avec Gemini, Google cherche à sécuriser son approvisionnement tout en gagnant un avantage compétitif sur l'efficacité énergétique, un critère de plus en plus déterminant à mesure que les data centers dédiés à l'IA consomment des quantités croissantes d'électricité. Rien ne garantit cependant que le projet aboutira dans les termes décrits, et l'horizon 2028 laisse une marge importante avant toute confirmation industrielle.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Google prévoit une nouvelle puce « Frozen » pour exécuter ses modèles d'IA bien plus efficacement45The Information AIInfrastructure 02Le puce "Frozen v2" de Google intégrerait directement l'architecture de Gemini dans le silicium pour des gains d'efficacité41The DecoderInfrastructure 03Google lance ses puces TPU 8, trois fois plus puissantes, pour accélérer l'entraînement IA et réduire les coûts cloud47Interesting EngineeringInfrastructure 
Dossier · GeminiSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.