Aller au contenu principal
Memories.ai développe une couche de mémoire visuelle pour les wearables et la robotique
RobotiqueTechCrunch AI · 1 min de lecture

Memories.ai développe une couche de mémoire visuelle pour les wearables et la robotique

Source originale ↗·

Memories.ai s'attaque à l'un des défis fondamentaux de l'intelligence artificielle embarquée : doter les machines d'une mémoire visuelle persistante et interrogeable. La startup développe un grand modèle de mémoire visuelle capable d'indexer et de retrouver des souvenirs enregistrés en vidéo, ouvrant la voie à une nouvelle génération d'IA physique.

L'enjeu est considérable pour deux secteurs en pleine expansion : les wearables (lunettes connectées, appareils portables) et la robotique. Jusqu'ici, les systèmes d'IA traitaient les flux vidéo en temps réel sans capacité de rappel structuré, chaque interaction repartait de zéro. Une couche de mémoire visuelle longue durée change radicalement ce paradigme, permettant à un robot ou un assistant porté de relier une situation présente à des événements passés.

Le cœur du projet repose sur un modèle capable d'indexer automatiquement des séquences vidéo et d'en extraire des souvenirs récupérables à la demande. Cette approche, baptisée « physical AI », vise des applications concrètes : un robot industriel qui reconnaît un objet déjà manipulé, des lunettes AR qui retrouvent où un utilisateur a posé ses clés, ou encore des assistants personnels qui construisent une mémoire épisodique de la vie quotidienne.

Si les détails techniques et le financement de Memories.ai restent pour l'instant limités, la direction prise s'inscrit dans une tendance lourde de l'industrie : après la mémoire textuelle des LLMs, la prochaine frontière est la mémoire multimodale ancrée dans le monde physique, un domaine où Google, Meta et plusieurs startups spécialisées se livrent déjà une concurrence intense.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Genesis AI lance Nyx, Quadrants et Genesis World 1.0, une plateforme physique pour évaluer les modèles de robotique à grande échelle
1MarkTechPost 

Genesis AI lance Nyx, Quadrants et Genesis World 1.0, une plateforme physique pour évaluer les modèles de robotique à grande échelle

Genesis AI a lancé Genesis World 1.0, une plateforme de simulation conçue pour accélérer le développement des modèles de fondation en robotique. La suite se compose de quatre éléments : un moteur physique, Nyx (un moteur de rendu par lancer de rayons en temps réel), Quadrants (un compilateur Python vers GPU), et une interface de simulation. Le problème que tente de résoudre cette plateforme est concret : évaluer une politique robotique sur une centaine de tâches avec plusieurs centaines d'épisodes chacune nécessite normalement plus de 200 heures de fonctionnement continu avec un opérateur humain et un seul robot. Genesis World 1.0 ramène cette même évaluation à moins de 30 minutes, sans intervention humaine ni matériel physique, avec une reproductibilité bit à bit des résultats. C'est un gain d'environ deux ordres de grandeur sur le temps de cycle d'évaluation. Ce bond de performance change fondamentalement la manière dont les équipes de recherche peuvent comparer des variantes de modèles. Jusqu'ici, la lenteur de l'évaluation réelle obligeait à faire des choix brutaux sur le nombre de checkpoints testés, biaisant de facto les décisions de développement. Genesis AI a délibérément choisi d'utiliser la simulation pour l'évaluation avant de l'utiliser pour la génération de données d'entraînement, et ce pour une raison méthodologique précise : si entraînement et évaluation partagent la même distribution simulée, un gain de performance peut simplement refléter une meilleure adaptation au simulateur, et non un progrès réel. L'approche retenue, baptisée "zero-shot real-to-sim", consiste à évaluer en simulation des politiques entraînées exclusivement sur des données réelles. Les résultats de corrélation sont probants : la corrélation de Pearson entre les performances en simulation et sur robot physique atteint 0,8996 (intervalle de confiance à 95 % : [0,7439 ; 0,9314]), calculée sur trois variantes de modèles (Small, Medium, Large), 14 tâches et 200 épisodes par tâche, avec un million d'itérations bootstrap. Le Mean Maximum Rank Violation (MMRV) s'établit à 0,0166, ce qui signifie que le simulateur préserve fidèlement le classement relatif des modèles entre eux. Genesis AI évolue dans un secteur en pleine structuration, où des acteurs comme Google DeepMind, Physical Intelligence ou encore Boston Dynamics investissent massivement dans les modèles de fondation pour la robotique généraliste. La qualité du simulateur est devenue un avantage compétitif direct : Genesis revendique un écart de réalité réduit de 45 % par rapport au meilleur simulateur concurrent, mesuré par le score FID sur leur jeu de données. Pour diagnostiquer précisément les sources de divergence simulation-réalité, l'équipe a construit un banc de test côte à côte permettant de faire fonctionner simultanément le simulateur et un robot physique depuis la même initialisation, en permutant les sources d'observations (caméra, proprioception) pour isoler si les écarts viennent de la physique, du rendu, des communications ou du contrôle. Nyx, le moteur de rendu intégré, vise des images 1080p sans bruit en moins de 4 millisecondes sur un GPU grand public haut de gamme, en s'appuyant sur le lancer de rayons matériel et des splats gaussiens 3D pour les zones où la reconstruction en maillage reste insuffisante.

💬 200 heures d'évaluation robotique ramenées à 30 minutes, c'est pas un gain marginal, c'est un changement de paradigme dans la façon dont on peut itérer sur les modèles. Ce qui m'intéresse surtout, c'est leur choix de séparer les distributions d'entraînement et d'évaluation : simuler les deux ensemble, c'est se mentir à soi-même, et ils l'ont compris. Bon, la corrélation à 0,89 est impressionnante sur le papier, reste à voir si ça tient sur des tâches vraiment hors distribution.

RobotiqueActu
1 source
Le directeur de la robotique de Nvidia : les agents IA vont provoquer un moment ChatGPT pour la robotique
2The Information AI 

Le directeur de la robotique de Nvidia : les agents IA vont provoquer un moment ChatGPT pour la robotique

Nvidia mise sur les agents IA pour déclencher une révolution dans la robotique comparable à l'émergence de ChatGPT. C'est le pari affiché par Deepu Talla, vice-président en charge de la robotique et de l'edge AI chez le géant des semi-conducteurs, lors de la conférence annuelle GTC à San Jose, en Californie. Pour Talla, la convergence entre agents IA et robotique physique est inévitable : les systèmes agentiques sont d'abord conçus pour le monde numérique, mais leur extension au monde physique ne représente qu'une étape supplémentaire. Cette vision pourrait transformer en profondeur l'industrie robotique, en abaissant drastiquement les barrières à l'entrée pour déployer et piloter des flottes de machines autonomes. Selon Deepu Talla, un seul agent IA pourrait coordonner une flotte entière de robots : il décomposerait un objectif global en tâches spécifiques, puis les distribuerait aux différents robots concernés. Plus significatif encore, cette approche agentique simplifierait et accélérerait l'intégration de nouveaux robots dans un système existant, avec la même fluidité qu'un utilisateur qui s'inscrit sur ChatGPT pour la première fois. Nvidia positionne ainsi ses travaux en robotique comme le prolongement naturel de son infrastructure pour l'IA générative, capitalisant sur l'élan autour des agents autonomes pour conquérir un marché industriel à fort potentiel.

RobotiqueActu
1 source
Mecka AI obtient 60 millions de dollars pour développer ses robots IA
3Le Big Data 

Mecka AI obtient 60 millions de dollars pour développer ses robots IA

La startup new-yorkaise Mecka AI a annoncé le 1er juin 2026 une levée de fonds totale de 60 millions de dollars pour accélérer le développement de son infrastructure de données destinée à la robotique intelligente. Ce financement se décompose en deux tours menés par Framework Ventures : une série A de 25 millions de dollars bouclée en novembre 2025, suivie d'un second tour de 35 millions. Parmi les autres investisseurs figurent Menlo Ventures, SV Angel, Kindred Ventures et Ted Xiao, ancien chercheur chez Google DeepMind. La société affirme déjà avoir sécurisé des contrats lui permettant de viser 100 millions de dollars de revenus annuels. Fondée par Josh Gao et Mogen Cheng, qui n'ont aucun passé dans les grands laboratoires d'IA mais viennent de la fintech et de la crypto, Mecka AI développe des dispositifs propriétaires combinant capteurs corporels et iPhone pour enregistrer à grande échelle les gestes, déplacements et interactions physiques des humains. L'enjeu central est de résoudre un problème fondamental de la robotique moderne : le manque de données dites "incarnées". Contrairement à l'IA générative, qui s'entraîne sur du texte, des images ou de l'audio, un robot qui doit agir dans le monde physique a besoin de comprendre comment un corps humain coordonne ses mouvements. Mecka AI transforme ces comportements en données d'entraînement structurées, offrant aux modèles robotiques une base plus naturelle et plus riche que la téléopération classique, où un humain pilote directement le robot pour générer des exemples d'apprentissage. Cette approche pourrait accélérer le développement de robots polyvalents capables d'opérer dans des environnements non contrôlés, de l'entrepôt logistique au domicile. Le financement de Mecka AI s'inscrit dans un repositionnement plus large du capital-risque technologique. Après des années d'investissements massifs dans les grands modèles de langage, une fraction croissante du capital se déplace vers l'IA physique, ce segment qui cherche à connecter les capacités algorithmiques à des actions concrètes dans le monde réel. Wayve, de son côté, entraîne ses systèmes de conduite autonome sur des flux vidéo embarqués, tandis que MicroAGI collecte des données dans des foyers américains pour sa robotique domestique. Mecka AI ambitionne d'industrialiser cette collecte à travers des verticales multiples et d'en faire une couche d'infrastructure partagée pour l'ensemble de l'écosystème robotique. L'originalité du profil de ses fondateurs, venus de la fintech plutôt que de la recherche académique, suggère une approche davantage orientée vers la scalabilité commerciale que vers la publication scientifique.

RobotiqueOpinion
1 source
NVIDIA lance des compétences agents pour l'IA physique : véhicules autonomes, robotique et vision
4NVIDIA AI Blog 

NVIDIA lance des compétences agents pour l'IA physique : véhicules autonomes, robotique et vision

NVIDIA a profité de la conférence CVPR 2026 pour dévoiler une série de nouveaux outils d'IA physique destinés aux chercheurs travaillant sur les véhicules autonomes, la robotique et les systèmes de vision artificielle. Ces annonces s'appuient sur le lancement, quelques jours plus tôt, de NVIDIA Cosmos 3, présenté comme le premier modèle fondamental unifié de l'industrie combinant raisonnement visuel, génération de mondes et génération d'actions. Parmi les outils dévoilés figurent InstantNuRec, qui reconstruit des scènes routières en 3D à partir d'images sans optimisation par scène ; AlpaGym, un framework open source d'apprentissage par renforcement en boucle fermée capable de s'exécuter sur des milliers de GPU ; OmniDreams, un modèle génératif qui produit des rendus photoréalistes en temps réel en réponse aux actions d'une politique de conduite ; et Alpamayo 2 Super, un modèle VLA (vision-langage-action) de 32 milliards de paramètres conçu pour le développement de véhicules autonomes de niveau 4. Le problème central que cherche à résoudre NVIDIA est la fragmentation des workflows en IA physique. Aujourd'hui, reconstruire une scène réelle, générer des scénarios rares, entraîner une politique, évaluer son comportement et itérer rapidement implique de jongler entre des outils disparates, ce qui ralentit considérablement la recherche. Pour les véhicules autonomes en particulier, le défi est la « longue traîne » des situations de conduite : les interactions rares, les géométries routières inhabituelles, les variations d'éclairage qui sont difficiles à collecter en conditions réelles mais critiques pour la validation. Les nouveaux outils de NVIDIA permettent aux agents IA d'automatiser ces étapes, de la reconstruction de scènes à partir de données de flotte jusqu'à la génération de conditions synthétiques variées. Pour la vision industrielle, des compétences Metropolis permettent de générer des défauts visuels rares sur différentes surfaces, résolvant le problème chronique du manque de données pour la détection d'anomalies. Ces annonces s'inscrivent dans une stratégie cohérente de NVIDIA pour s'imposer comme infrastructure de référence de l'IA physique, un marché qu'elle considère comme la prochaine vague majeure après les grands modèles de langage. Cosmos 3, socle de l'ensemble de l'écosystème présenté, est positionné comme modèle ouvert dominant sur les benchmarks publics de l'IA physique. En combinant simulation haute fidélité, modèles fondateurs ouverts et frameworks d'entraînement scalables, NVIDIA tente de reproduire avec l'IA embarquée et robotique ce qu'elle a réussi dans le calcul haute performance : rendre son infrastructure si centrale que les chercheurs n'envisagent pas d'alternatives. Les prochaines étapes passeront par l'adoption de ces outils par les grands constructeurs automobiles et les laboratoires de robotique, qui testent actuellement leurs capacités sur des flottes réelles.

UELes constructeurs automobiles européens (Renault, Stellantis, BMW) et les laboratoires de recherche en robotique pourront utiliser ces outils open-source pour accélérer le développement de véhicules autonomes de niveau 4 et réduire leur dépendance à la collecte de données réelles.

RobotiqueOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic