Aller au contenu principal
Les employés d'OpenAI suggèrent un nouveau modèle omnibus
LLMsThe Decoder · 1 min de lecture

Les employés d'OpenAI suggèrent un nouveau modèle omnibus

Source originale ↗·

Des publications d'employés d'OpenAI et un projet audio filtré appelé "BiDi" suggèrent que la société travaille sur un nouveau modèle omni multimodal. Ce prochain modèle représenterait une mise à niveau majeure des capacités multimodales d'OpenAI.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1Siècle Digital 

Meta lance un nouveau modèle d’IA, pour tenter de rattraper Google et OpenAI

Meta a lancé mercredi 8 avril son nouveau modèle d'intelligence artificielle baptisé Muse Spark, première production officielle des Meta Superintelligence Labs. Ce lancement représente le résultat d'un investissement de 14,3 milliards de dollars engagé par le groupe de Mark Zuckerberg dans sa course pour rivaliser avec Google et OpenAI sur le marché des modèles de fondation les plus avancés. Ce lancement marque un tournant stratégique pour Meta, qui cherche à dépasser son image de simple acteur open source. La famille Llama avait jusqu'ici construit la réputation d'un Meta généreux, distribuant ses modèles librement à la communauté des développeurs. Avec Muse Spark, l'entreprise semble viser un positionnement différent, plus orienté vers la compétition directe avec les modèles propriétaires de Google DeepMind et d'OpenAI. Pour les entreprises et développeurs qui avaient misé sur l'écosystème Llama, cette bifurcation soulève des questions sur la cohérence de la stratégie IA de Meta. Le contexte de ce lancement est tendu : Meta accélère ses dépenses en IA à un rythme inédit, alors que la concurrence entre grands modèles s'intensifie avec les sorties récentes de Gemini 2.0 et GPT-4o. La création des Meta Superintelligence Labs signale une réorganisation interne profonde, visant à concentrer les meilleurs talents sur les systèmes les plus ambitieux. Les prochains mois diront si Muse Spark peut réellement combler le retard accumulé face aux leaders du secteur.

UELe lancement de Muse Spark et le pivot stratégique de Meta vers le propriétaire oblige les entreprises et développeurs européens ayant misé sur l'écosystème Llama open source à réévaluer leurs choix d'infrastructure IA.

LLMsOpinion
1 source
Alibaba lance un nouveau modèle d'IA propriétaire
2The Information AI 

Alibaba lance un nouveau modèle d'IA propriétaire

Alibaba a lancé jeudi un nouveau grand modèle de langage baptisé Qwen3.6-Plus, en mettant en avant ses capacités avancées dans le domaine des agents IA autonomes. Ce lancement marque un tournant notable pour le géant technologique chinois, qui propose cette fois un modèle en accès fermé, à l'inverse de sa stratégie habituelle. En l'espace de deux ans, Alibaba s'était imposé comme l'un des leaders mondiaux de l'open source en IA, notamment grâce à la série Qwen, largement adoptée par la communauté internationale des développeurs. Ce changement de cap a des implications concrètes pour les milliers d'équipes techniques qui utilisaient les modèles Qwen comme base libre pour leurs propres applications. Un modèle fermé signifie moins de transparence sur l'architecture, l'impossibilité de l'héberger soi-même, et une dépendance accrue aux infrastructures cloud d'Alibaba. Pour l'industrie, c'est aussi le signal que les grandes entreprises chinoises commencent à monétiser plus agressivement leurs avancées en IA, après une phase de conquête par l'open source. Ce virage intervient dans un contexte de compétition mondiale intense entre géants tech américains et chinois sur le terrain des modèles frontières. OpenAI, Google et Anthropic maintiennent leurs modèles les plus puissants en accès fermé ; Alibaba, Meta et Mistral avaient jusqu'ici joué la carte inverse pour gagner en adoption. Le lancement de Qwen3.6-Plus suggère qu'Alibaba estime désormais avoir suffisamment de poids pour imposer ses conditions, et que la phase gratuite de l'IA ouverte touche peut-être à sa fin pour les acteurs majeurs.

UELes équipes européennes qui utilisaient les modèles Qwen comme base open source devront reconsidérer leur architecture, le passage au modèle fermé impliquant une dépendance accrue aux infrastructures cloud d'Alibaba et la perte de la liberté d'auto-hébergement.

💬 Alibaba qui passe au fermé, c'est un peu la fin de la récré. Pendant deux ans, la série Qwen a été une aubaine pour des milliers d'équipes qui voulaient de la puissance sans l'addition, et ceux qui ont construit dessus vont devoir revoir leurs plans. Le vrai signal ici, c'est que la phase de conquête par l'open source est terminée : Alibaba a sa base d'utilisateurs, elle la monétise.

LLMsOpinion
1 source
Mistral publie un nouveau modèle open source pour la génération vocale
3TechCrunch AI 

Mistral publie un nouveau modèle open source pour la génération vocale

Mistral AI franchit une nouvelle étape dans sa stratégie open source en publiant un modèle dédié à la génération vocale, conçu pour s'exécuter entièrement en local sur des appareils à faibles ressources, smartphones, montres connectées ou autres terminaux embarqués. La startup française confirme ainsi sa volonté d'étendre son portefeuille bien au-delà des modèles de texte, vers des modalités audio jusqu'ici dominées par les géants américains. L'enjeu est de taille : proposer une synthèse vocale de qualité sans dépendance au cloud. En rendant le traitement entièrement local, Mistral répond à trois contraintes majeures pour les développeurs et les utilisateurs, la confidentialité des données, l'absence de latence réseau et la disponibilité hors connexion. Un positionnement qui constitue un différenciateur direct face aux solutions propriétaires de Google, Apple ou Microsoft, dont les moteurs vocaux centralisent systématiquement le traitement sur des serveurs distants. Fondée en 2023, Mistral AI s'est imposée comme l'acteur européen le plus actif dans la course aux modèles open source compétitifs, avec des jalons successifs, Mistral 7B, Mixtral, et plusieurs modèles spécialisés. Cette incursion dans la génération audio s'inscrit dans la tendance sectorielle vers des modèles multimodaux compacts. La capacité annoncée à fonctionner sur une montre connectée laisse supposer une optimisation poussée, probablement via des techniques de quantification ou de distillation, domaine dans lequel les équipes de Mistral ont déjà démontré leur maîtrise. Le fait que ce modèle soit publié en open source renforce la cohérence de la stratégie de la startup, qui mise sur l'adoption communautaire comme levier de croissance face aux modèles fermés. Les détails techniques, nom officiel du modèle, benchmarks et date de disponibilité générale, restaient à confirmer au moment de la publication.

UEMistral AI, startup française de référence, lance un modèle de synthèse vocale open source exécutable en local sur appareils embarqués, renforçant la souveraineté technologique européenne face aux solutions cloud américaines.

LLMsActu
1 source
Le PDG d'OpenAI redistribue les responsabilités et prépare le modèle IA 'Spud
4The Information AI 

Le PDG d'OpenAI redistribue les responsabilités et prépare le modèle IA 'Spud

Sam Altman abandonne la supervision directe des équipes de sécurité et de sûreté d'OpenAI pour se concentrer sur des priorités stratégiques : la levée de capitaux, les chaînes d'approvisionnement et la construction de datacenters à une échelle sans précédent. Cette redistribution des responsabilités marque un tournant dans l'organisation interne de la startup, révélée dans un message adressé aux équipes ce mardi. Ce repositionnement intervient dans un contexte de concurrence intense, notamment face à Anthropic et Google, qui intensifient elles aussi leurs investissements en infrastructure. En déléguant la sécurité, Altman signale que la priorité absolue d'OpenAI est désormais la course aux ressources computationnelles, un facteur devenu aussi déterminant que l'algorithme lui-même dans la rivalité entre les grands acteurs de l'IA. Sur le plan produit, Altman a annoncé l'achèvement du développement initial de son prochain grand modèle, dont le nom de code interne est Spud. Parallèlement, la société met fin à l'application mobile Sora AI Video, dont les employés se plaignaient qu'elle mobilisait une part excessive des ressources de calcul, une décision qui illustre les arbitrages difficiles auxquels OpenAI est confrontée dans la gestion de ses capacités. Ce remaniement soulève des questions sur l'équilibre entre ambition industrielle et rigueur en matière de sécurité chez OpenAI : confier la supervision des équipes de sûreté à d'autres mains, alors que la société développe des modèles toujours plus puissants, ne manquera pas d'alimenter le débat sur la gouvernance de l'IA dans les semaines à venir.

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic