Aller au contenu principal
Apple obtient un accès complet à Gemini et utilise la distillation pour créer une IA légère embarquée
LLMsThe Decoder · 1 min de lecture

Apple obtient un accès complet à Gemini et utilise la distillation pour créer une IA légère embarquée

Source originale ↗·

Apple a officiellement conclu un accord avec Google pour obtenir un accès complet à Gemini, dans le but de distiller des modèles d'IA plus compacts destinés à fonctionner directement sur ses appareils. Cette approche, connue sous le nom de distillation de modèles, consiste à entraîner un modèle plus léger en s'appuyant sur les sorties d'un modèle plus puissant, une technique qui permet d'obtenir des performances élevées sans la puissance de calcul d'un grand modèle.

L'enjeu est considérable pour Apple, qui mise sur l'IA embarquée comme différenciateur clé face à la concurrence. Plutôt que de dépendre exclusivement du cloud ou de licencier directement des modèles tiers, la firme de Cupertino cherche à produire des modèles propriétaires suffisamment performants pour tourner sur iPhone, iPad et Mac, tout en préservant la confidentialité des données utilisateurs, un argument central dans sa communication.

Ce qui rend cet accord notable, c'est sa dimension stratégique : Apple paie légalement pour un accès que plusieurs entreprises chinoises auraient obtenu de façon non autorisée, en utilisant les sorties de modèles comme ChatGPT ou Gemini pour entraîner leurs propres systèmes. En formalisant cette relation avec Google, Apple s'inscrit dans une démarche de conformité tout en accélérant le développement de Siri et des fonctionnalités Apple Intelligence.

La distillation à partir de Gemini pourrait permettre à Apple de combler rapidement son retard sur Google, Microsoft et OpenAI dans la course aux assistants IA, sans avoir à construire from scratch des modèles de la taille de ceux de ses concurrents, une voie pragmatique qui repose sur la puissance des géants du secteur pour alimenter son propre écosystème.

Impact France/UE

Les utilisateurs européens d'appareils Apple bénéficieront indirectement d'une IA embarquée plus performante sur Siri, sans impact réglementaire direct sur la France ou l'UE.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Apple peut « distiller » le grand modèle Gemini de Google
1The Information AI 

Apple peut « distiller » le grand modèle Gemini de Google

Le partenariat entre Apple et Google autour de l'intelligence artificielle se révèle bien plus profond qu'anticipé. Selon une source directement informée de l'accord, Apple dispose d'un accès complet au modèle Gemini de Google dans ses propres centres de données, et pas seulement d'une capacité à le peaufiner à la marge. Concrètement, cet accès permet à Apple de procéder à ce que les ingénieurs appellent la distillation : une technique qui consiste à extraire les connaissances d'un grand modèle pour produire des versions compactes, optimisées pour des tâches précises ou suffisamment légères pour tourner directement sur les appareils Apple. L'enjeu est stratégique, exécuter des modèles on-device réduit la latence, protège la vie privée des utilisateurs et réduit la dépendance aux serveurs cloud, une ressource sous haute tension. Ce niveau d'accès dépasse ce qui avait été rapporté jusqu'ici. Il ne s'agit plus simplement d'un droit de fine-tuning sur une version bridée de Gemini, mais d'une intégration profonde de la technologie Google dans l'infrastructure Apple. Cela laisse entendre que Siri et les fonctionnalités Apple Intelligence promises depuis plusieurs mois pourraient s'appuyer sur des modèles dérivés de Gemini, taillés sur mesure pour les usages mobiles et embarqués. Ce partenariat prend une dimension particulière dans le contexte actuel : OpenAI procède simultanément à une réorganisation majeure et abandonne Sora, son outil de génération vidéo, jugé trop gourmand en ressources serveur. La compétition pour les infrastructures GPU est intense, et la capacité d'Apple à internaliser la distillation de modèles lui confère un avantage opérationnel non négligeable face à ses concurrents.

LLMsOpinion
1 source
2Frandroid 

La « Personal Intelligence » de Gemini devient gratuite pour des millions d’utilisateurs

Google vient de rendre gratuite sa fonctionnalité « Personal Intelligence » intégrée à Gemini, jusqu'alors réservée aux abonnés payants à partir de 20 dollars par mois. Ce changement de stratégie tarifaire ouvre l'accès à des millions d'utilisateurs qui n'avaient pas franchi le pas de l'abonnement premium. La Personal Intelligence, dévoilée en début 2026, permet à Gemini de mieux personnaliser ses réponses en tenant compte du contexte propre à chaque utilisateur. En rendant cette capacité accessible gratuitement, Google accélère l'adoption de masse et positionne Gemini comme un assistant IA véritablement personnel, sans barrière financière. Le passage d'un tarif de 20 $/mois à la gratuité représente un mouvement tarifaire significatif, qui traduit une pression concurrentielle croissante sur le marché des assistants IA. Des acteurs comme OpenAI avec ChatGPT ou Anthropic avec Claude proposent eux aussi des fonctionnalités avancées à leurs utilisateurs gratuits, forçant Google à revoir sa stratégie de monétisation. Cette ouverture pourrait marquer un tournant dans la guerre des assistants IA : là où les entreprises cherchaient à monétiser les fonctionnalités différenciantes, la tendance semble désormais être à la démocratisation pour maximiser la base d'utilisateurs actifs, quitte à reporter la monétisation sur d'autres leviers.

UELes utilisateurs européens de Gemini bénéficient désormais gratuitement d'une fonctionnalité d'IA personnalisée auparavant payante, élargissant l'accès à des outils d'IA avancés sans abonnement.

LLMsActu
1 source
ChatGPT 5.4 Mini : les utilisateurs ont enfin accès à la nouvelle IA OpenAI
3Le Big Data 

ChatGPT 5.4 Mini : les utilisateurs ont enfin accès à la nouvelle IA OpenAI

OpenAI franchit une nouvelle étape en démocratisant son modèle GPT-5.4 Mini, désormais accessible à tous les utilisateurs, y compris ceux du plan gratuit. Lancé officiellement le 17 mars 2026, ce modèle vient compléter la gamme GPT-5.4, jusqu'ici réservée aux développeurs et entreprises. Malgré son nom, ce modèle n'a rien d'une version allégée au rabais. GPT-5.4 Mini surpasse son prédécesseur GPT-5 Mini sur les axes essentiels : raisonnement, codage, compréhension multimodale et utilisation d'outils. Il est également plus de deux fois plus rapide que GPT-5 Mini, ce qui en fait un outil particulièrement adapté aux usages quotidiens de productivité. Sa fenêtre de contexte de 400 000 tokens lui permet de traiter des requêtes longues et complexes sans perdre le fil. Sur les benchmarks, les résultats sont éloquents : GPT-5.4 Mini atteint 53,4 % sur SWE-Bench Pro, contre 57,7 % pour GPT-5.4. L'écart est limité, ce qui confirme que la version Mini n'est pas un simple produit d'appel. Disponible directement depuis l'interface ChatGPT en activant l'option « Thinking », il prend également le relais pour les abonnés payants dès que leur quota GPT-5.4 est épuisé, une logique de continuité de service bien pensée. Avec cette stratégie, Sam Altman et OpenAI installent une hiérarchie lisible entre leurs modèles tout en élargissant leur base d'utilisateurs. La disponibilité gratuite de GPT-5.4 Mini constitue un argument concurrentiel fort face à Google, Anthropic et Meta, qui se disputent eux aussi le segment grand public.

UELes utilisateurs français et européens, y compris les non-abonnés, peuvent désormais accéder gratuitement à un modèle de raisonnement avancé avec une fenêtre de contexte de 400 000 tokens.

LLMsActu
1 source
Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini
4The Decoder 

Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini

Lors de sa conférence développeurs Google I/O, tenue cette semaine, Google a dévoilé plusieurs annonces majeures dans le domaine de l'intelligence artificielle. Au programme : un nouveau modèle de langage baptisé Gemini 3.5 Flash, conçu pour allier rapidité et efficacité, un modèle multimodal nommé Gemini Omni capable de traiter simultanément texte, images, audio et vidéo, ainsi qu'un agent personnel cloud appelé Gemini Spark, pensé pour fonctionner en continu, vingt-quatre heures sur vingt-quatre. L'application Gemini bénéficie par ailleurs d'une refonte visuelle et fonctionnelle complète. L'introduction de Gemini Spark marque un tournant dans la vision de Google pour l'IA personnelle. Contrairement aux assistants classiques qui se contentent de répondre à des requêtes ponctuelles, un agent cloud permanent peut exécuter des tâches de façon autonome, anticiper des besoins, surveiller des données ou déclencher des actions sans intervention humaine. Pour les développeurs comme pour les utilisateurs grand public, cela ouvre la voie à une nouvelle catégorie d'assistants proactifs, toujours disponibles et potentiellement connectés à l'ensemble des services Google. Ces annonces s'inscrivent dans une course effrénée à l'IA agentique que se livrent Google, OpenAI et Microsoft depuis début 2025. Google cherche à reprendre l'initiative après avoir été perçu comme en retrait face aux avancées de GPT-4o et des agents d'OpenAI. Avec cette vague de lancements, l'entreprise signale sa volonté de positionner Gemini non plus comme un simple chatbot, mais comme une infrastructure d'IA omniprésente, ancrée dans le cloud et intégrée à l'ensemble de son écosystème.

UELes nouveaux modèles Gemini et l'agent cloud permanent seront accessibles aux développeurs et entreprises européens, accélérant l'adoption de l'IA agentique dans l'écosystème Google en Europe.

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic