Aller au contenu principal
Le premier CPU signé Arm va équiper les datacenters IA de Meta plus tard cette année
InfrastructureThe Verge AI · 1 min de lecture

Le premier CPU signé Arm va équiper les datacenters IA de Meta plus tard cette année

Source originale ↗·

Arm franchit une étape historique en lançant son premier processeur maison, l'Arm AGI CPU, destiné aux datacenters d'intelligence artificielle. Après des décennies à se limiter à la conception de designs de puces sous licence, la société britannique passe à la fabrication directe, et son premier client n'est autre que Meta.

Ce changement de stratégie marque un tournant majeur pour Arm, dont le modèle économique reposait jusqu'ici exclusivement sur la vente de licences à des fabricants tiers comme Qualcomm, Apple ou Samsung. En entrant dans l'arène de la production de puces, Arm se positionne désormais comme un acteur à part entière dans la course aux infrastructures IA, un secteur en pleine explosion où les besoins en puissance de calcul pour l'inférence, c'est-à-dire l'exécution des modèles en temps réel, ne cessent de croître.

L'Arm AGI CPU est conçu spécifiquement pour l'inférence cloud, notamment pour alimenter des agents IA capables de démultiplier les tâches en parallèle. Meta se positionne à la fois comme partenaire principal et co-développeur de la puce, avec des engagements portant sur plusieurs générations de processeurs datacenter. Ce partenariat intervient alors que Meta aurait rencontré des difficultés à lancer ses propres puces maison. Le CPU sera déployé aux côtés de matériel de fournisseurs tiers tels que Nvidia et AMD.

Cette alliance illustre une tendance de fond : les grands acteurs du web cherchent à diversifier leurs sources de silicium pour réduire leur dépendance à Nvidia, tout en s'appuyant sur des partenaires capables de co-concevoir des solutions sur mesure. Pour Arm, c'est l'occasion de capturer une plus grande part de la valeur générée par ses architectures, dans un contexte où ses designs dominent déjà une large part du marché mobile mondial.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Anthropic cherche à louer ses premiers data centers avec le soutien financier de Google
1The Information AI 

Anthropic cherche à louer ses premiers data centers avec le soutien financier de Google

Anthropic, la société à l'origine du modèle Claude, franchit une nouvelle étape dans son autonomisation technologique en cherchant à contrôler sa propre infrastructure de calcul. L'entreprise a signé ces derniers mois plus d'une dizaine de lettres d'intention pour louer des centres de données auprès de différents développeurs immobiliers américains, selon plusieurs sources proches du dossier. En parallèle, ses dirigeants auraient engagé des discussions avec Google pour que le géant de Mountain View se porte garant financier des paiements de loyers liés à ces baux. Cette démarche vise avant tout à réduire les coûts de calcul sur le long terme, qui représentent aujourd'hui une charge colossale pour les laboratoires d'IA. En contrôlant directement ses serveurs plutôt qu'en s'appuyant exclusivement sur des fournisseurs cloud, Anthropic gagnerait en flexibilité opérationnelle et diminuerait sa dépendance aux tarifs imposés par des tiers. La participation de Google est particulièrement significative : le groupe co-conçoit certaines puces serveurs susceptibles d'équiper ces nouvelles installations, ce qui renforcerait une intégration verticale déjà en cours. Google est l'un des principaux investisseurs d'Anthropic, aux côtés d'Amazon, qui a engagé jusqu'à 4 milliards de dollars dans la startup. Cette quête d'infrastructure propre s'inscrit dans une tendance plus large : OpenAI, xAI et Google DeepMind investissent eux aussi massivement dans leurs propres capacités de calcul, transformant la maîtrise des data centers en avantage concurrentiel décisif dans la course à l'intelligence artificielle générale.

InfrastructureActu
1 source
Des data centers IA flottants alimentés par les vagues de l'océan : la Silicon Valley mise sur cette piste
2Ars Technica AI 

Des data centers IA flottants alimentés par les vagues de l'océan : la Silicon Valley mise sur cette piste

Des investisseurs de la Silicon Valley, dont Peter Thiel, cofondateur de Palantir, ont misé des centaines de millions de dollars sur un concept inédit : des centres de données flottants alimentés par l'énergie des vagues océaniques. Le dernier tour de financement, d'un montant de 140 millions de dollars annoncé le 4 mai, doit permettre à la startup Panthalassa de finaliser une installation pilote de fabrication près de Portland, en Oregon, et d'accélérer le déploiement de ses "nœuds" marins. Ces plateformes flottantes captent l'énergie des vagues pour alimenter directement des puces d'intelligence artificielle embarquées, puis transmettent les résultats des modèles, sous forme de tokens d'inférence, aux clients via liaison satellite, sans jamais passer par un data center terrestre. L'enjeu est de taille : ce modèle transforme un problème de transport d'énergie en un problème de transport de données, une substitution potentiellement décisive. Comme l'explique Benjamin Lee, ingénieur et architecte informatique à l'Université de Pennsylvanie, "réaliser du calcul IA sur l'océan nécessite de transférer les modèles vers les nœuds en mer, puis de répondre aux requêtes". Concrètement, cela signifie que les opérateurs n'auraient plus besoin de construire des lignes à haute tension ni de négocier l'accès au réseau électrique terrestre, deux obstacles majeurs qui ralentissent actuellement le déploiement de l'infrastructure IA à grande échelle. Cette initiative émerge dans un contexte où les géants de la tech font face à des difficultés croissantes pour implanter des data centers sur la terre ferme : contraintes foncières, pénuries énergétiques locales, délais de raccordement au réseau et oppositions réglementaires freinent les projets de Microsoft, Google ou Amazon. Le secteur cherche des alternatives radicales, qu'il s'agisse de l'énergie nucléaire modulaire ou, désormais, de l'offshore. Panthalassa devra encore démontrer la fiabilité de ses nœuds face aux conditions marines extrêmes, la latence acceptable pour les cas d'usage IA, et la viabilité économique à grande échelle, autant de défis techniques que le pilote de Portland sera chargé de valider.

InfrastructureActu
1 source
IA : cette avancée de Google qui fait trembler les fabricants de puces sur les marchés
3La Tribune 

IA : cette avancée de Google qui fait trembler les fabricants de puces sur les marchés

Google a annoncé TurboQuant, un algorithme de compression capable de réduire drastiquement les besoins en mémoire vive des grands modèles de langage (LLM). L'annonce, faite en mars 2026, a provoqué une réaction immédiate sur les marchés financiers : les actions des fabricants de mémoires et de puces, dont Micron et SK Hynix, ont fortement chuté en Bourse dès la publication de la nouvelle. L'impact potentiel est considérable pour toute l'industrie des semi-conducteurs. Si TurboQuant tient ses promesses, les data centers et les développeurs d'IA auront besoin de beaucoup moins de RAM pour faire tourner des modèles de grande taille, ce qui représente une menace directe sur les volumes de vente de mémoire HBM (High Bandwidth Memory), un segment très lucratif dominé par Samsung, SK Hynix et Micron. Pour les utilisateurs et les entreprises qui déploient des LLM, cela pourrait en revanche signifier des coûts d'infrastructure nettement réduits et une accessibilité accrue à des modèles puissants. Cette avancée s'inscrit dans une course plus large à l'efficacité des modèles d'IA, où la quantisation et la compression sont devenues des axes majeurs de recherche depuis 2023. Des techniques comme GPTQ ou AWQ avaient déjà tracé la voie, mais Google, fort de ses ressources et de sa maîtrise de l'infrastructure, entend ici passer à une nouvelle échelle. La question qui agite désormais le secteur est de savoir si TurboQuant sera intégré à Gemini et aux offres cloud de Google, ce qui accélérerait considérablement son adoption industrielle.

UELes entreprises et développeurs européens déployant des LLM pourraient bénéficier d'une réduction sensible des coûts d'infrastructure mémoire si TurboQuant est intégré aux offres cloud grand public.

💬 TurboQuant ne change pas ce qu'on peut faire tourner sur nos GPU quant à la taille des modèles eux-mêmes — mais il transforme des modèles "techniquement possibles" en modèles réellement utilisables avec un vrai contexte long. Pour illustrer : avec une RTX 5080, les modèles 12-14B passent de ~10K à ~60-100K tokens de contexte, soit une fenêtre quasi illimitée pour ces tailles. De quoi faire trembler les fabricants de puces, effectivement.

InfrastructureOpinion
1 source
Google et SpaceX explorent des data centers spatiaux en orbite pour l’IA
4Le Big Data 

Google et SpaceX explorent des data centers spatiaux en orbite pour l’IA

Google et SpaceX seraient en pourparlers avancés sur le déploiement de centres de données en orbite basse, destinés à héberger des charges de calcul dédiées à l'intelligence artificielle. Selon le Wall Street Journal, les deux groupes étudient un accord qui permettrait à Google d'utiliser les capacités de lancement de SpaceX pour placer progressivement des infrastructures informatiques dans l'espace. Cette initiative reste encore au stade exploratoire, sans confirmation officielle d'Elon Musk, mais elle s'inscrit dans un contexte où SpaceX prépare une introduction en bourse valorisée à près de 1 750 milliards de dollars, pariant sur la viabilité économique future de ces infrastructures orbitales. Google ne limiterait pas non plus ses discussions à SpaceX, en parallèle de discussions avec d'autres acteurs du secteur spatial, tout en avançant sur son projet Suncatcher, annoncé en 2018, dont les premiers prototypes de satellites sont attendus à partir de 2027. L'enjeu est considérable pour l'industrie tech. Les modèles d'IA générative réclament des volumes de calcul en croissance exponentielle, tandis que les data centers terrestres se heurtent à des limites de plus en plus contraignantes : consommation électrique massive, occupation foncière importante, et opposition croissante de riverains et d'élus dans plusieurs États américains. Des projets entiers ralentissent en raison d'inquiétudes autour de l'utilisation de l'eau, de l'empreinte carbone et de la pression sur les réseaux électriques locaux. Des infrastructures en orbite permettraient, en théorie, de contourner ces contraintes géographiques et réglementaires tout en ouvrant une nouvelle réserve de capacité de calcul décorrélée des tensions foncières terrestres. Elon Musk avance même que le coût d'exploitation de tels centres pourrait s'avérer inférieur à celui des data centers classiques, à mesure que les coûts de lancement continuent de baisser. Ce mouvement vers l'espace s'inscrit dans une recomposition plus large des alliances autour de l'IA et des infrastructures. Anthropic et SpaceX ont récemment signé un accord portant sur l'accès aux ressources de calcul du centre de données de xAI à Memphis, avec des perspectives de collaboration sur des projets spatiaux à plus long terme. SpaceX a par ailleurs renforcé son positionnement dans l'écosystème IA après le rachat de xAI en février 2026, transformant l'entreprise de lancement en acteur intégré de la chaîne de valeur de l'intelligence artificielle. Si les data centers orbitaux restent une vision à horizon de plusieurs années, la convergence entre les géants du cloud, les fournisseurs de fusées et les laboratoires d'IA dessine d'ores et déjà les contours d'une bataille pour le contrôle des infrastructures du calcul de demain.

UELa domination américaine sur les futures infrastructures orbitales accentue les enjeux de souveraineté numérique pour l'Europe, sans impact opérationnel direct à court terme.

💬 La contrainte des data centers terrestres, c'est réelle, et si tu suis l'actu US tu vois des projets ralentir partout, faute d'élec ou à cause des riverains. Du calcul en orbite basse, ça a du sens sur le fond, j'y crois. Mais le timing colle un peu trop bien avec l'IPO de SpaceX à 1 750 milliards pour pas se poser de questions.

InfrastructureOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic