Aller au contenu principal
Créez avec Nano Banana 2, notre meilleur modèle de génération et d'édition d'images
OutilsGoogle AI Blog · 1 min de lecture

Créez avec Nano Banana 2, notre meilleur modèle de génération et d'édition d'images

Source originale ↗·

Nano Banana 2 (Gemini 3.1 Flash Image) est le nouveau modèle de génération et d'édition d'images de Google, offrant une intelligence et une fidélité de niveau Pro pour toutes les applications d'image. Il apporte les capacités du modèle Pro dans un format optimisé pour les développeurs souhaitant intégrer la génération d'images dans leurs projets.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Créez avec Lyria 3, notre nouveau modèle de génération musicale
1Google AI Blog 

Créez avec Lyria 3, notre nouveau modèle de génération musicale

Google vient de franchir une nouvelle étape dans la course à la génération musicale par intelligence artificielle en lançant Lyria 3, son modèle le plus avancé à ce jour. Disponible dès maintenant en préversion payante via l'API Gemini et en accès gratuit dans Google AI Studio, ce modèle ouvre la porte à l'intégration de création musicale directement dans des applications tierces. Cette mise à disposition via API représente un tournant stratégique pour Google DeepMind : en ciblant directement les développeurs, l'entreprise cherche à ancrer Lyria 3 au cœur de l'écosystème applicatif, bien au-delà des seuls outils grand public. Pour les créateurs de contenu, les plateformes de jeux vidéo ou les applications de médias, la possibilité de générer de la musique de haute qualité par simple appel API change radicalement la donne. Lyria 3 est la dernière itération de la famille Lyria, la gamme de modèles musicaux développée par Google DeepMind. Elle se positionne comme une concurrente directe de Suno et Udio, deux acteurs qui ont imposé leurs outils auprès du grand public ces derniers mois. Son intégration native à l'écosystème Gemini constitue un avantage différenciant majeur : les développeurs déjà familiarisés avec les outils Google pourront l'adopter sans friction supplémentaire. La disponibilité gratuite dans Google AI Studio suggère une stratégie d'acquisition progressive, visant à convertir les expérimentateurs en clients payants une fois les cas d'usage validés. Cette approche, rodée par Google sur d'autres modèles de l'écosystème Gemini, pourrait accélérer significativement l'adoption de Lyria 3 par la communauté des développeurs IA.

OutilsActu
1 source
Créez avec Veo 3.1 Lite, notre modèle de génération vidéo le plus accessible
2Google AI Blog 

Créez avec Veo 3.1 Lite, notre modèle de génération vidéo le plus accessible

Google a mis en disponibilité Veo 3.1 Lite, sa nouvelle version allégée de modèle de génération vidéo, en accès payant via l'API Gemini et en test gratuit sur Google AI Studio. Présenté comme le modèle de génération vidéo le plus économique de la gamme, il s'adresse aux développeurs et entreprises souhaitant intégrer la création vidéo IA dans leurs applications sans supporter les coûts de la version complète Veo 3.1. Ce lancement répond à une demande croissante de solutions vidéo IA accessibles pour les équipes produit et les startups. En proposant une alternative moins coûteuse, Google ouvre la génération vidéo à une base bien plus large de développeurs, au-delà des grandes entreprises capables d'absorber les tarifs premium. La disponibilité directe via l'API Gemini facilite l'intégration dans des pipelines existants. Veo 3.1 Lite s'inscrit dans la stratégie de Google de démocratiser ses outils d'IA générative face à la concurrence de Sora d'OpenAI et Runway. La famille Veo, lancée en 2024, monte progressivement en accessibilité après avoir ciblé initialement les partenaires enterprise. La phase de "paid preview" suggère une disponibilité générale prochaine, avec des tarifs définitifs à préciser.

UELes développeurs et startups européens peuvent désormais intégrer la génération vidéo IA dans leurs pipelines applicatifs à moindre coût via l'API Gemini.

OutilsOutil
1 source
L'Uni-1 de Luma AI pourrait être le premier vrai rival à la domination de Google Nano Banana en génération d'images
3The Decoder 

L'Uni-1 de Luma AI pourrait être le premier vrai rival à la domination de Google Nano Banana en génération d'images

Luma AI vient de dévoiler Uni-1, un modèle d'intelligence artificielle qui ambitionne de bousculer l'hégémonie établie par Google et OpenAI dans la génération d'images. Sa particularité : une architecture unifiée qui combine à la fois la compréhension et la création d'images au sein d'un même système, capable de raisonner activement sur les prompts au fur et à mesure qu'il génère les visuels. L'enjeu est considérable dans un secteur où Google s'est imposé comme référence incontournable avec ses modèles de génération d'images, notamment dans le segment dit "Nano Banana". Jusqu'ici, peu de concurrents avaient réussi à challenger sérieusement cette domination. Uni-1 représente une approche architecturale différente, en supprimant la séparation traditionnelle entre les modules de perception et de synthèse visuelle, une piste que la communauté de recherche suit avec intérêt depuis plusieurs années. L'originalité technique d'Uni-1 réside dans sa capacité à "raisonner" pendant la génération, à la manière des modèles de type chain-of-thought appliqués au texte. Cette architecture unifiée distingue le modèle de Luma AI des approches en pipeline classiques où compréhension et génération restent des étapes séparées. La société, déjà connue pour ses outils de génération vidéo, monte ainsi en gamme sur le marché de l'image fixe, se positionnant directement face aux offres phares d'OpenAI (DALL·E, gpt-image-1) et de Google (Imagen). Si les premières démonstrations confirment les ambitions de Luma AI, Uni-1 pourrait redéfinir les standards d'évaluation pour la génération d'images, un marché en pleine consolidation où l'intégration raisonnement-génération s'impose progressivement comme le prochain axe de différenciation majeur.

OutilsActu
1 source
Proton lance son assistant IA Lumo 2.0 avec génération d’images et mémoire
4Next INpact 

Proton lance son assistant IA Lumo 2.0 avec génération d’images et mémoire

Proton a dévoilé le 2 juillet 2026 la version 2.0 de Lumo, son assistant IA, un an après son lancement en juillet 2025. L'éditeur suisse, connu pour ses services chiffrés (Proton Mail, Proton VPN), revendique aujourd'hui dix millions d'utilisateurs pour cet assistant construit sur la promesse d'une confidentialité totale, avec chiffrement de bout en bout, garantie zéro accès et absence de logs. Cette nouvelle mouture, présentée comme le changement le plus important depuis la création du produit, repose sur une architecture repensée et se décline en quatre modes : Lite pour les tâches courantes, Max pour le raisonnement complexe, Fast pour les réponses rapides, et Thinking pour les analyses multi-étapes avec raisonnement visible en temps réel. Sur le plan des performances, Proton annonce, via l'Artificial Analysis Intelligence Index, un score en hausse de 127% pour Lumo 2.0 Lite et de 240% pour Lumo 2.0 Max par rapport à la version 1.4, ce dernier modèle atteignant 51 points, entre les 44 de Claude Sonnet 4.6 et les 55 de GPT-5.5. Cette mise à jour vise avant tout à combler le retard de Lumo sur ses concurrents directs. L'assistant devient multimodal, capable d'analyser des images, d'en générer à partir d'un prompt ou d'une esquisse, et de les éditer au sein d'une même conversation, le tout couvert par la garantie zéro accès. Autre ajout attendu de longue date : la recherche web avec citation des sources, ainsi qu'une mémoire persistante permettant à l'assistant de retenir préférences et style d'un utilisateur, avec un contrôle total laissé à ce dernier sur ce qui est conservé ou effacé. La fenêtre de contexte a également doublé, sans que Proton ne communique de chiffre précis, et de nouvelles fonctions collaboratives font leur apparition : les Projects, des espaces de travail chiffrés regroupant conversations, fichiers et instructions, et les Custom Lumos, des assistants personnalisés comparables aux Gems de Google Gemini. Ces annonces s'inscrivent dans une bataille plus large où les acteurs mettant en avant la confidentialité, comme Proton, cherchent à rattraper l'écart technique avec les géants du secteur sans sacrifier leur positionnement éthique. Andy Yen, PDG de Proton, a déclaré via 9to5Mac que les tests utilisateurs montrent une différence qualitative de moins en moins perceptible entre Lumo 2.0 Max et les derniers modèles d'OpenAI et d'Anthropic, une affirmation qui reste toutefois celle du fabricant et non d'un benchmark indépendant. Un test publié par It's FOSS relativise d'ailleurs ce discours, pointant des limites sur certaines tâches comme l'édition d'image. Reste à voir si ces gains techniques suffiront à convaincre au-delà de la base d'utilisateurs déjà acquise à la promesse de confidentialité de Proton.

UEProton, éditeur suisse très implanté en Europe, propose aux utilisateurs français et européens soucieux de confidentialité une alternative chiffrée aux assistants IA américains.

💬 Proton comble son retard technique, mais le score de 51 points vient de leur propre benchmark, pas d'un tiers indépendant, donc je prends ça avec des pincettes. Bonne nouvelle quand même : la confidentialité totale n'est plus synonyme d'assistant IA au rabais, dix millions d'utilisateurs en un an ça prouve que la demande existe. Reste que It's FOSS a déjà trouvé les limites sur l'édition d'image, donc l'écart avec Claude et GPT-5.5 est sans doute moins fermé que ce que dit Andy Yen.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic