Aller au contenu principal
Une nouvelle façon d'exprimer son identité : Gemini peut désormais créer de la musique
LLMsGoogle AI Blog · 1 min de lecture

Une nouvelle façon d'exprimer son identité : Gemini peut désormais créer de la musique

Source originale ↗·

Lyria 3 est désormais disponible dans l'application Gemini, permettant aux utilisateurs de créer des pistes musicales personnalisées de haute qualité de 30 secondes à partir de textes et d'images. Cette fonctionnalité offre une nouvelle manière d'exprimer la créativité via la génération d'œuvres audio à partir de contenus multimédias.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Grâce à Lyria 3 Pro, l’IA Gemini de Google peut maintenant créer de la musique de 3 minutes
1Presse-citron 

Grâce à Lyria 3 Pro, l’IA Gemini de Google peut maintenant créer de la musique de 3 minutes

Google franchit une nouvelle étape dans la génération musicale par IA avec le lancement de Lyria 3 Pro, une version améliorée de son modèle Lyria 3 sorti en février dernier. Intégré directement à Gemini, l'assistant IA de Google, ce nouveau modèle est capable de composer des morceaux d'une durée allant jusqu'à 3 minutes, une avancée significative par rapport aux générations précédentes limitées à des extraits courts. Cette évolution s'inscrit dans une course effrénée entre les géants technologiques sur le terrain de la création musicale automatisée. Proposer des compositions de 3 minutes change fondamentalement l'usage : on passe d'un simple générateur d'ambiances à un outil capable de produire des titres complets, exploitables dans des projets audiovisuels, des podcasts ou des créations indépendantes. L'intégration dans Gemini positionne Google face à des concurrents comme Suno et Udio, qui dominent aujourd'hui ce segment. Lyria 3 Pro est réservé aux abonnés payants de Gemini, ce qui reflète la stratégie de Google de monétiser ses capacités IA avancées via ses offres premium. Le modèle succède à Lyria 3, lancé en février 2026, et constitue la déclinaison haute performance de la famille Lyria, le programme de recherche musicale de Google DeepMind. La cadence de mise à jour, moins de deux mois entre Lyria 3 et Lyria 3 Pro, témoigne de l'intensité du développement dans ce domaine. Si Google ne détaille pas encore publiquement les capacités stylistiques précises de ce nouveau modèle, la durée étendue et la qualité attendue d'une version "Pro" laissent entrevoir un outil qui pourrait séduire créateurs de contenu et professionnels du secteur audiovisuel.

LLMsActu
1 source
Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini
2The Decoder 

Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini

Lors de sa conférence développeurs Google I/O, tenue cette semaine, Google a dévoilé plusieurs annonces majeures dans le domaine de l'intelligence artificielle. Au programme : un nouveau modèle de langage baptisé Gemini 3.5 Flash, conçu pour allier rapidité et efficacité, un modèle multimodal nommé Gemini Omni capable de traiter simultanément texte, images, audio et vidéo, ainsi qu'un agent personnel cloud appelé Gemini Spark, pensé pour fonctionner en continu, vingt-quatre heures sur vingt-quatre. L'application Gemini bénéficie par ailleurs d'une refonte visuelle et fonctionnelle complète. L'introduction de Gemini Spark marque un tournant dans la vision de Google pour l'IA personnelle. Contrairement aux assistants classiques qui se contentent de répondre à des requêtes ponctuelles, un agent cloud permanent peut exécuter des tâches de façon autonome, anticiper des besoins, surveiller des données ou déclencher des actions sans intervention humaine. Pour les développeurs comme pour les utilisateurs grand public, cela ouvre la voie à une nouvelle catégorie d'assistants proactifs, toujours disponibles et potentiellement connectés à l'ensemble des services Google. Ces annonces s'inscrivent dans une course effrénée à l'IA agentique que se livrent Google, OpenAI et Microsoft depuis début 2025. Google cherche à reprendre l'initiative après avoir été perçu comme en retrait face aux avancées de GPT-4o et des agents d'OpenAI. Avec cette vague de lancements, l'entreprise signale sa volonté de positionner Gemini non plus comme un simple chatbot, mais comme une infrastructure d'IA omniprésente, ancrée dans le cloud et intégrée à l'ensemble de son écosystème.

UELes nouveaux modèles Gemini et l'agent cloud permanent seront accessibles aux développeurs et entreprises européens, accélérant l'adoption de l'IA agentique dans l'écosystème Google en Europe.

LLMsActu
1 source
SpaceXAI lance Grok 4.5 : Tout savoir sur la nouvelle IA de code d’Elon Musk
3Le Big Data 

SpaceXAI lance Grok 4.5 : Tout savoir sur la nouvelle IA de code d’Elon Musk

SpaceXAI, l'entreprise d'Elon Musk, a officiellement lancé Grok 4.5 le 8 juillet 2026, après plusieurs semaines de tests en version bêta. Présenté comme le modèle le plus avancé de la société, il cible en priorité le développement logiciel, les tâches agentiques (où l'IA enchaîne plusieurs actions de façon autonome) et les usages professionnels. Musk le classe dans la catégorie des modèles « Opus », en référence directe à la gamme d'Anthropic. Techniquement, Grok 4.5 repose sur une architecture de 1 500 milliards de paramètres entraînée grâce au supercalculateur Colossus, avec la participation de Cursor comme partenaire d'entraînement. Sur le plan des performances, il affiche 83,3 % sur Terminal-Bench 2.1 contre 78,9 % pour Claude Opus 4.8, et 62 % sur DeepSWE 1.0 contre 55,8 % pour son rival. En revanche, Claude Opus 4.8 garde l'avantage sur SWE-Bench Multilingual (84,4 % contre 78 %) et sur SWE-Bench Pro, qui évalue la correction de vrais bugs (69,2 % contre 64,7 %). Ces chiffres comptent parce qu'ils redessinent la concurrence sur le marché des IA de code, un segment devenu stratégique pour les développeurs et les entreprises tech. Grok 4.5 revendique un net avantage économique : il génère jusqu'à 80 tokens par seconde, facturés 2 dollars par million de tokens en entrée et 6 dollars en sortie, et SpaceXAI affirme qu'il consomme jusqu'à quatre fois moins de tokens que Claude Opus 4.8 pour une tâche équivalente. Concrètement, cela pourrait réduire sensiblement la facture des professionnels qui l'utilisent au quotidien via Grok Build, Cursor ou une clé API, même si le modèle ne domine pas systématiquement les benchmarks de programmation les plus exigeants. Ce lancement illustre l'accélération continue de la course aux modèles d'IA, où chaque acteur promet d'être plus rapide, plus performant et moins cher que le précédent. Il s'inscrit aussi dans un contexte de surveillance croissante de la part des autorités américaines : la sortie de Grok 4.5 avait été retardée le mois dernier à la demande du gouvernement des États-Unis, qui souhaitait examiner les risques d'utilisation abusive des modèles d'IA les plus avancés, un scénario déjà observé avec GPT 5.6 et Fable 5. Pour les utilisateurs européens, la patience reste de mise puisque le déploiement dans l'Union européenne n'est prévu que pour la mi-juillet. Reste à voir si SpaceXAI parviendra à transformer cet avantage tarifaire en gains de parts de marché face à Anthropic et OpenAI, dans un secteur où l'écart entre les modèles se resserre benchmark après benchmark.

UELe déploiement de Grok 4.5 dans l'Union européenne est prévu pour la mi-juillet 2026, sans impact réglementaire ou concurrentiel direct pour les entreprises européennes à ce stade.

LLMsOpinion
1 source
Apple peut « distiller » le grand modèle Gemini de Google
4The Information AI 

Apple peut « distiller » le grand modèle Gemini de Google

Le partenariat entre Apple et Google autour de l'intelligence artificielle se révèle bien plus profond qu'anticipé. Selon une source directement informée de l'accord, Apple dispose d'un accès complet au modèle Gemini de Google dans ses propres centres de données, et pas seulement d'une capacité à le peaufiner à la marge. Concrètement, cet accès permet à Apple de procéder à ce que les ingénieurs appellent la distillation : une technique qui consiste à extraire les connaissances d'un grand modèle pour produire des versions compactes, optimisées pour des tâches précises ou suffisamment légères pour tourner directement sur les appareils Apple. L'enjeu est stratégique, exécuter des modèles on-device réduit la latence, protège la vie privée des utilisateurs et réduit la dépendance aux serveurs cloud, une ressource sous haute tension. Ce niveau d'accès dépasse ce qui avait été rapporté jusqu'ici. Il ne s'agit plus simplement d'un droit de fine-tuning sur une version bridée de Gemini, mais d'une intégration profonde de la technologie Google dans l'infrastructure Apple. Cela laisse entendre que Siri et les fonctionnalités Apple Intelligence promises depuis plusieurs mois pourraient s'appuyer sur des modèles dérivés de Gemini, taillés sur mesure pour les usages mobiles et embarqués. Ce partenariat prend une dimension particulière dans le contexte actuel : OpenAI procède simultanément à une réorganisation majeure et abandonne Sora, son outil de génération vidéo, jugé trop gourmand en ressources serveur. La compétition pour les infrastructures GPU est intense, et la capacité d'Apple à internaliser la distillation de modèles lui confère un avantage opérationnel non négligeable face à ses concurrents.

LLMsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic