Aller au contenu principal
Création · Actu ·

LTX-2.5 génère une vidéo IA de 10 secondes à partir d'une image en 6,8 secondes sur les superpuces Nvidia, et c'est open weights

LTX, la société de modèles de monde en open source issue de Lightricks, a lancé LTX-2.5, la nouvelle version de son modèle vidéo et de monde à poids ouverts. Le modèle s'intègre nativement dans ComfyUI, l'outil de workflow par nœuds devenu la référence pour prototyper des générations open source, dans le cadre d'un partenariat de lancement entre les deux entreprises. LTX-2.5 est disponible en accès libre sur Hugging Face, dans ComfyUI, et via l'API de LTX pour les équipes qui veulent une génération managée : gratuit pour les organisations sous 10 millions de dollars de revenus récurrents annuels, avec licence négociée au-delà. LTX revendique déjà 33 millions de téléchargements pour sa famille de modèles, ce qui en ferait la ligne de "modèles de monde" open source la plus utilisée du marché. Le co-fondateur et PDG de LTX, Zeev Farbman, a présenté en exclusivité à VentureBeat les nouveautés : un nouveau décodeur vidéo par diffusion qui réduit les artefacts visuels sur les scènes à fort mouvement, un support natif du multi-plans qui garde personnages, décor et voix cohérents sur une séquence entière, un socle de langage Gemma 4 personnalisé pour mieux traiter les prompts complexes, un checkpoint pré-entraîné pour l'IA physique et la robotique, ainsi qu'un modèle distillé amélioré tournant localement sur les GPU Nvidia RTX. Sur le plan des performances, LTX annonce la génération d'un clip de 10 secondes en 720p à partir d'une image en 6,8 secondes sur deux puces Nvidia GB200 haut de gamme auto-hébergées, plus rapide que le temps réel, contre 23,7 secondes via son API managée en 1080p.

3 min de lecturePertinence 60
Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Cette accélération et cette ouverture des poids changent la donne pour les studios, développeurs indépendants et équipes de recherche qui veulent générer de la vidéo par IA sans dépendre exclusivement d'API fermées et coûteuses. LTX affirme que son modèle coûte environ huit fois moins cher et rend sept fois plus vite que des modèles comparables, avec un fonctionnement possible aussi bien sur des GPU de datacenter que sur un Mac. Dans des tests de préférence humaine à l'aveugle, LTX-2.5 obtient un taux de victoire de 67%, devant Seedance 2.5 (65%), Gemini Omni Flash de Google (55%), MiniMax H3 (50%), Seedance 2.0 (44%), Wan 2.6 (42%) et FLUX 3 (28%). Comparé à la concurrence sur la vitesse de génération, LTX cite des temps nettement supérieurs pour Gemini Omni Flash (52 secondes), Grok 1.5 de xAI (63 secondes), Veo 3.1 de Google (70 secondes pour un clip de 8 secondes), MiniMax H3 (180 secondes), Seedance 2.5 de ByteDance (317 secondes) et Kling 3.0 Pro de Kuaishou (398 secondes).

Ce lancement s'inscrit dans une bataille plus large entre modèles vidéo à poids ouverts et API fermées, où LTX et ComfyUI parient que l'accessibilité et la personnalisation locale l'emporteront sur les services propriétaires verrouillés de géants comme Google, xAI, ByteDance ou Kuaishou. L'ajout d'un checkpoint dédié à la robotique et à l'IA physique signale aussi une ambition dépassant la simple génération de vidéos cinématographiques, en visant des usages industriels où les équipes pourront affiner le modèle sur leurs propres données. Toutes les mesures de vitesse et de qualité citées proviennent de LTX lui-même ou de tests commandités par l'entreprise, ce qui invite à la prudence en attendant des comparatifs indépendants. Reste à voir si l'écosystème ComfyUI, déjà central dans la communauté open source de génération d'images et de vidéos, parviendra à consolider LTX comme standard face à la pression des géants du cloud qui investissent massivement dans leurs propres modèles fermés.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Génération d'images IA d'entreprise en 2 secondes : Krea 2 Raw et Turbo en open weights sous licence personnalisée48VentureBeat AICréation 02Flux 3 génère des vidéos avec audio natif jusqu'à 20 secondes, une première pour Black Forest Labs49The DecoderCréation 03Grok Imagine Video 1.5 : cette IA génère maintenant des vidéos avec le son43Le Big DataCréation 
Dossier · Open weight & Open sourceSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.