Aller au contenu principal
OutilsInfoQ AI · 1 min de lecture

Présentation : concevoir une IA créative et curieuse sur mobile

Source originale ↗·

Voici la traduction et le résumé demandés :

Bhavuk Jain, ingénieur chez Google, a présenté les coulisses techniques de deux produits d'intelligence artificielle grand public déployés à grande échelle sur mobile : AI Wallpapers et Circle to Search. Dans son intervention, il détaille comment son équipe transforme des modèles d'IA fondamentaux en fonctionnalités utilisables au quotidien par des millions d'utilisateurs Android. Il aborde notamment la mise en place de garde-fous à l'exécution (runtime guardrails) pour sécuriser les sorties du modèle, les techniques de fine-tuning appliquées à ces cas d'usage spécifiques, ainsi que l'intégration profonde de ces outils au système d'exploitation mobile.

Cette présentation s'adresse en priorité aux responsables techniques confrontés à un défi commun dans l'industrie : faire cohabiter les contraintes d'expérience utilisateur avec la latence des modèles d'IA et le coût de l'infrastructure nécessaire pour les faire tourner. Livrer une IA à la fois fiable et sûre sur des appareils mobiles, où les ressources sont limitées et où l'utilisateur attend une réponse quasi instantanée, reste un exercice d'équilibriste technique et économique. Les choix d'architecture présentés ici offrent un cas d'étude concret pour toute équipe cherchant à industrialiser des fonctionnalités d'IA générative au-delà du prototype.

Circle to Search et AI Wallpapers illustrent une tendance de fond chez les grands acteurs technologiques : l'intégration native de l'IA générative directement dans le système d'exploitation plutôt que dans des applications tierces séparées. Cette approche pose des défis spécifiques en matière de sécurité des contenus générés, de gestion des coûts de calcul à grande échelle et de cohérence de l'expérience utilisateur sur des millions d'appareils simultanément. L'intervention de Jain s'inscrit dans un ensemble plus large de retours d'expérience d'ingénieurs confrontés au passage de la recherche en IA à des produits industriels robustes et sécurisés.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Roblox Build, une IA créateur de jeux sur mobile ! Tout savoir
1Le Big Data 

Roblox Build, une IA créateur de jeux sur mobile ! Tout savoir

Roblox a dévoilé Build, un nouvel outil de création intégré directement à son application mobile, qui permet de générer un jeu jouable à partir d'une simple description textuelle, sans passer par l'éditeur Roblox Studio. Il suffit à l'utilisateur de saisir le nom d'un jeu ou d'un personnage pour que le service produise un point de départ modifiable, testable et partageable entre amis. L'outil s'appuie sur une combinaison de modèles d'intelligence artificielle open source et propriétaires, capables de générer mécaniques de jeu, personnages, sons et styles visuels. David Baszucki, le dirigeant de Roblox, présente Build comme une nouvelle façon de créer directement depuis son téléphone. L'alpha publique doit s'ouvrir le 28 juillet 2026, d'abord en Nouvelle-Zélande avant une extension progressive à d'autres régions, et sera limitée aux utilisateurs vérifiés âgés d'au moins neuf ans. Une version de base restera gratuite, certaines fonctionnalités avancées devenant payantes. Cette annonce marque un tournant pour Roblox, qui compte des millions d'utilisateurs quotidiens et cherche à élargir son vivier de créateurs au-delà des studios expérimentés déjà familiers de Roblox Studio. En rendant la création aussi simple qu'un message texte, la plateforme espère abaisser radicalement la barrière technique qui freinait jusqu'ici les amateurs souhaitant concevoir leurs propres univers. Pour l'industrie du jeu vidéo, cela confirme une tendance de fond où l'IA générative devient un outil de production accessible au grand public, et pas seulement aux développeurs professionnels. Roblox précise toutefois que chaque jeu créé via Build devra passer un contrôle de sécurité avant sa diffusion aux utilisateurs de seize ans et plus, et que les productions suivront le même classement que les autres contenus de la plateforme, fondé sur la fidélisation des joueurs. L'IA fournit donc un tremplin technique, mais ne garantit ni visibilité ni succès automatique. Build s'inscrit dans la continuité du slogan historique de Roblox, "vous créez le jeu", lancé il y a près de vingt ans et désormais doté d'une portée bien plus concrète grâce à l'IA. Un projet démarré sur mobile pourra être poursuivi dans Roblox Studio puis repris ensuite sur smartphone, assurant une continuité entre les deux environnements plutôt qu'un simple gadget isolé. Parallèlement, Roblox déploie trois agents IA destinés à ses créateurs les plus actifs et déjà expérimentés sur Studio : un agent de test qui détecte les bugs avant publication, un agent d'analyse capable de répondre à des questions en langage naturel sur les données de jeu, et un agent de recommandation suggérant des ajustements pour améliorer l'engagement. Cette double stratégie, simplifier l'accès pour les novices tout en outillant davantage les équipes chevronnées, illustre la manière dont les grandes plateformes de jeu misent désormais sur l'intelligence artificielle pour stimuler à la fois le volume et la qualité des contenus générés par leurs communautés.

OutilsOutil
1 source
NVIDIA et Google Cloud misent sur la prochaine génération de créateurs en IA
2NVIDIA AI Blog 

NVIDIA et Google Cloud misent sur la prochaine génération de créateurs en IA

À l'occasion de Google I/O 2026, NVIDIA et Google Cloud ont annoncé une série de nouvelles ressources pour leur communauté de développeurs commune, qui regroupe désormais plus de 100 000 membres. Lancée lors de Google I/O l'année précédente, cette communauté réunit développeurs, data scientists et ingénieurs en machine learning autour de l'écosystème NVIDIA sur Google Cloud. Parmi les nouveautés dévoilées cette année : un parcours d'apprentissage dédié à la bibliothèque JAX sur GPU NVIDIA, un codelab centré sur NVIDIA Dynamo pour l'optimisation de l'inférence, ainsi que des livestreams mensuels. Les développeurs peuvent désormais déployer des applications multi-agents en combinant les modèles ouverts Gemma 4 de Google DeepMind, les modèles NVIDIA Nemotron et le Google Agent Development Kit, sur des machines virtuelles G4 de Google Cloud équipées de GPU NVIDIA RTX PRO 6000 Blackwell, via Google Cloud Run ou des instances spot. Le nouveau parcours JAX et le codelab NVIDIA Dynamo sur GKE seront disponibles le mois prochain pour les membres de la communauté. Ces annonces ont un impact direct pour les équipes techniques qui cherchent à passer du prototype à la production rapidement. En combinant des modèles ouverts, des bibliothèques accélérées comme cuDF dans Google Colab Enterprise ou Dataproc, et une infrastructure GPU de dernière génération, les développeurs disposent d'un pipeline complet pour construire des applications d'IA prêtes pour la production : des systèmes RAG (retrieval-augmented generation) sur GKE aux pipelines de données d'entreprise en passant par l'analyse sportive. La collaboration sur JAX, framework de calcul numérique utilisé notamment par Google DeepMind pour l'entraînement de grands modèles, étend ces optimisations jusqu'à la plateforme Google Cloud AI Hypercomputer et au framework MaxText, permettant de passer d'expériences sur un seul GPU à des déploiements multi-rack avec une expérience cohérente. L'un des volets les plus significatifs du partenariat concerne l'IA responsable : NVIDIA est le premier partenaire industriel à avoir collaboré avec Google DeepMind sur SynthID, une technologie de tatouage numérique qui intègre des filigranes robustes directement dans les contenus générés par l'IA. Cette technologie est appliquée aux modèles Cosmos de NVIDIA, des modèles de fondation dédiés à la perception 3D et à la simulation pour robots et systèmes autonomes, disponibles sur build.nvidia.com. Dans un contexte où les agents IA combinent de plus en plus modèles propriétaires et open source pour raisonner et agir de manière autonome, cette couche de transparence devient un enjeu central pour la confiance des organisations qui déploient ces systèmes à grande échelle.

UELa technologie SynthID de filigrane numérique, développée avec Google DeepMind et intégrée aux modèles NVIDIA, répond directement aux obligations de transparence de l'AI Act européen sur les contenus générés par IA (Article 50).

OutilsOutil
1 source
3InfoQ AI 

LinkedIn présente son agent de mémoire cognitive pour les agents IA

LinkedIn a dévoilé le Cognitive Memory Agent (CMA), une couche d'infrastructure d'IA générative destinée à rendre les systèmes d'intelligence artificielle persistants et conscients du contexte dans lequel ils opèrent. Ce framework fournit une mémoire durable organisée en trois couches distinctes : épisodique, qui retient les interactions passées ; sémantique, qui stocke les connaissances générales ; et procédurale, qui encode les comportements appris. Le CMA prend également en charge la coordination entre plusieurs agents, la récupération d'informations et la gestion complète du cycle de vie des mémoires. Cette initiative s'attaque à une limitation fondamentale des grands modèles de langage : leur absence d'état entre les sessions. Sans mémoire externe, chaque interaction repart de zéro, rendant impossible toute personnalisation durable. En déployant le CMA dans ses propres applications, LinkedIn ouvre la voie à des assistants IA capables de se souvenir des préférences professionnelles d'un utilisateur, de ses recherches d'emploi passées ou de ses habitudes de networking, transformant ainsi l'expérience sur une plateforme de plus d'un milliard d'utilisateurs. La mémoire des agents est devenue l'un des chantiers prioritaires de l'industrie, alors que les entreprises cherchent à faire passer leurs systèmes d'IA du mode réactif au mode autonome et continu. OpenAI, Google DeepMind et Anthropic développent des architectures comparables, mais LinkedIn dispose d'un avantage singulier : une base de données professionnelles sans équivalent. Le CMA positionne l'entreprise pour intégrer ces capacités directement dans ses outils de recrutement, de formation et de recommandation, avec des implications profondes sur la façon dont les professionnels interagiront avec l'IA au quotidien.

UELes millions de professionnels français inscrits sur LinkedIn pourraient voir leurs interactions avec les outils de recrutement et de formation de la plateforme profondément transformées par cette couche de mémoire persistante.

OutilsOpinion
1 source
Google lance une application pour utiliser son IA en local sur iPhone et Android
4Numerama 

Google lance une application pour utiliser son IA en local sur iPhone et Android

Google a lancé AI Edge Gallery, une nouvelle application disponible sur iPhone et Android permettant de faire tourner des modèles d'intelligence artificielle directement sur l'appareil, sans connexion réseau. L'application s'appuie sur les modèles Gemma 4, la dernière génération de modèles open source légers de Google, conçus pour fonctionner sur des terminaux mobiles aux ressources limitées. Elle propose plusieurs expériences interactives exploitant ces capacités d'inférence locale. Cette initiative marque une étape concrète dans la course à l'IA embarquée sur smartphone. Faire tourner un modèle de langage en local élimine la latence réseau, préserve la confidentialité des données et permet une utilisation hors connexion, trois avantages majeurs pour les utilisateurs mobiles. Pour Google, c'est aussi un moyen de tester l'adoption de Gemma 4 auprès du grand public et de démontrer que ses modèles open source sont compétitifs sur des appareils du quotidien, face à des concurrents comme Apple Intelligence ou les solutions embarquées de Meta. Google s'inscrit ici dans une tendance de fond : après avoir imposé Gemini comme assistant par défaut sur Android, l'entreprise cherche à étendre sa présence sur iOS tout en investissant dans l'IA on-device. Gemma 4, présenté récemment, est précisément optimisé pour ce type de déploiement. AI Edge Gallery fonctionne pour l'instant comme un terrain d'expérimentation ouvert, ce qui laisse supposer qu'une intégration plus profonde dans les produits Google grand public pourrait suivre selon les retours des utilisateurs.

UEL'inférence locale préserve les données sur l'appareil, un avantage concret pour les utilisateurs européens soumis au RGPD, sans transfert vers des serveurs tiers.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic