Aller au contenu principal
Présentation de nos modèles audio de dernière génération via l'API
OutilsOpenAI Blog · 1 min de lecture

Présentation de nos modèles audio de dernière génération via l'API

Source originale ↗·

Pour la première fois, les développeurs peuvent maintenant diriger un modèle de conversion de texte en parole pour adopter un style spécifique, par exemple "parler comme un agent de service client empathique", débouchant sur une personnalisation accrue des agents vocaux.

Impact France/UE

Les entreprises françaises et européennes dans les secteurs de la technologie vocale et de l'IA peuvent améliorer la personnalisation de leurs agents vocaux grâce à cette nouvelle API, conformément aux exigences du RGPD et à l'attente de l'AI Act, en permettant aux développeurs de diriger les modèles de conversion texte en parole pour adopter des styles spécifiques, comme un agent de service client empathique.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Créez avec Lyria 3, notre nouveau modèle de génération musicale
1Google AI Blog 

Créez avec Lyria 3, notre nouveau modèle de génération musicale

Google vient de franchir une nouvelle étape dans la course à la génération musicale par intelligence artificielle en lançant Lyria 3, son modèle le plus avancé à ce jour. Disponible dès maintenant en préversion payante via l'API Gemini et en accès gratuit dans Google AI Studio, ce modèle ouvre la porte à l'intégration de création musicale directement dans des applications tierces. Cette mise à disposition via API représente un tournant stratégique pour Google DeepMind : en ciblant directement les développeurs, l'entreprise cherche à ancrer Lyria 3 au cœur de l'écosystème applicatif, bien au-delà des seuls outils grand public. Pour les créateurs de contenu, les plateformes de jeux vidéo ou les applications de médias, la possibilité de générer de la musique de haute qualité par simple appel API change radicalement la donne. Lyria 3 est la dernière itération de la famille Lyria, la gamme de modèles musicaux développée par Google DeepMind. Elle se positionne comme une concurrente directe de Suno et Udio, deux acteurs qui ont imposé leurs outils auprès du grand public ces derniers mois. Son intégration native à l'écosystème Gemini constitue un avantage différenciant majeur : les développeurs déjà familiarisés avec les outils Google pourront l'adopter sans friction supplémentaire. La disponibilité gratuite dans Google AI Studio suggère une stratégie d'acquisition progressive, visant à convertir les expérimentateurs en clients payants une fois les cas d'usage validés. Cette approche, rodée par Google sur d'autres modèles de l'écosystème Gemini, pourrait accélérer significativement l'adoption de Lyria 3 par la communauté des développeurs IA.

OutilsActu
1 source
Créez avec Veo 3.1 Lite, notre modèle de génération vidéo le plus accessible
2Google AI Blog 

Créez avec Veo 3.1 Lite, notre modèle de génération vidéo le plus accessible

Google a mis en disponibilité Veo 3.1 Lite, sa nouvelle version allégée de modèle de génération vidéo, en accès payant via l'API Gemini et en test gratuit sur Google AI Studio. Présenté comme le modèle de génération vidéo le plus économique de la gamme, il s'adresse aux développeurs et entreprises souhaitant intégrer la création vidéo IA dans leurs applications sans supporter les coûts de la version complète Veo 3.1. Ce lancement répond à une demande croissante de solutions vidéo IA accessibles pour les équipes produit et les startups. En proposant une alternative moins coûteuse, Google ouvre la génération vidéo à une base bien plus large de développeurs, au-delà des grandes entreprises capables d'absorber les tarifs premium. La disponibilité directe via l'API Gemini facilite l'intégration dans des pipelines existants. Veo 3.1 Lite s'inscrit dans la stratégie de Google de démocratiser ses outils d'IA générative face à la concurrence de Sora d'OpenAI et Runway. La famille Veo, lancée en 2024, monte progressivement en accessibilité après avoir ciblé initialement les partenaires enterprise. La phase de "paid preview" suggère une disponibilité générale prochaine, avec des tarifs définitifs à préciser.

UELes développeurs et startups européens peuvent désormais intégrer la génération vidéo IA dans leurs pipelines applicatifs à moindre coût via l'API Gemini.

OutilsOutil
1 source
Google lance Lyria 3 Pro, son nouveau modèle de génération musicale
3TechCrunch AI 

Google lance Lyria 3 Pro, son nouveau modèle de génération musicale

Google franchit une nouvelle étape dans la génération musicale par intelligence artificielle avec le lancement de Lyria 3 Pro, une version améliorée de son modèle dédié à la création sonore. Ce nouveau modèle est capable de produire des morceaux plus longs et offre davantage d'options de personnalisation, marquant une progression significative par rapport aux versions précédentes. L'enjeu est considérable dans un secteur où la concurrence s'intensifie autour des outils de création musicale assistée par IA. En intégrant Lyria 3 Pro à travers son écosystème, Gemini, ses produits enterprise et d'autres services, Google positionne clairement cette technologie comme un pilier transversal de son offre, aussi bien pour les créateurs individuels que pour les professionnels et les entreprises. Le modèle se distingue par sa capacité à générer des pistes musicales plus longues et plus adaptables aux besoins des utilisateurs, une limitation notable des générations précédentes. Le déploiement s'étend sur plusieurs plateformes Google, ce qui témoigne d'une stratégie d'intégration large plutôt qu'un produit isolé. Les détails techniques précis sur la durée maximale des pistes ou les paramètres de personnalisation disponibles n'ont pas encore été tous divulgués. Cette annonce s'inscrit dans une dynamique plus large où les grandes plateformes technologiques, Google, OpenAI, Meta ou encore Suno et Udio, investissent massivement dans la génération audio et musicale. La montée en puissance de Lyria 3 Pro suggère que Google entend s'imposer comme référence dans ce domaine, en capitalisant sur ses infrastructures existantes pour toucher un maximum d'utilisateurs et de cas d'usage professionnels.

OutilsActu
1 source
4Blog du Modérateur 

Microsoft présente MAI-Image-2, la nouvelle mouture de son générateur d’images par IA

Microsoft franchit une nouvelle étape dans sa course à l'IA générative avec le lancement de MAI-Image-2, un générateur d'images de nouvelle génération. Cette mise à jour traduit la volonté du géant de Redmond de renforcer son indépendance technologique dans le domaine de la création visuelle par IA, un segment en pleine expansion. Cette initiative s'inscrit dans la stratégie d'autonomie en IA que Microsoft déploie activement, cherchant à réduire sa dépendance vis-à-vis de partenaires externes pour les briques technologiques fondamentales. En développant ses propres modèles de génération d'images, l'entreprise consolide son écosystème et se positionne face à des concurrents directs comme Adobe Firefly, Google Imagen ou encore Midjourney. Les détails techniques de MAI-Image-2 restent à préciser, mais son nom, qui s'inscrit dans la famille des modèles MAI (Microsoft AI), signale clairement une filiation avec les efforts de recherche internes de l'entreprise. Ce modèle devrait alimenter les produits Microsoft 365, Designer et d'autres surfaces intégrées à l'écosystème Azure AI et Copilot. --- > Note : L'article source fourni est très succinct. Si vous disposez du texte complet, je peux produire un résumé nettement plus riche en chiffres, citations et détails factuels.

OutilsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic