Aller au contenu principal
Black Sesame Technologies rejoint l'écosystème open source HaloOS de Li Auto
RobotiquePandaily · 1 min de lecture

Black Sesame Technologies rejoint l'écosystème open source HaloOS de Li Auto

Source originale ↗·

Black Sesame Technologies a officiellement rejoint l'écosystème open source HaloOS de Li Auto, le constructeur automobile chinois. Ce partenariat prévoit une collaboration étroite sur le co-développement en open source, avec une adaptation approfondie et une optimisation des performances de HaloOS sur l'ensemble des plateformes de puces de Black Sesame, notamment les familles Huashan et Wudang. Ces composants couvrent un large spectre d'applications : systèmes d'aide à la conduite avancés (ADAS), cockpits intelligents et intégration multi-domaines. Concrètement, les cartes de développement intégrées à l'écosystème HaloOS adopteront les plateformes de puces de Black Sesame, qui ouvrira également son code source sur l'ensemble de sa gamme.

HaloOS est le système d'exploitation embarqué développé en interne par Li Auto, conçu spécifiquement pour les véhicules intelligents pilotés par l'IA. Il repose sur quatre piliers : le contrôle du véhicule, la conduite autonome, le middleware de communication et la sécurité informatique. Ce rapprochement avec Black Sesame renforce la capacité de Li Auto à proposer une plateforme logicielle indépendante des fournisseurs de puces, accélérant ainsi la maturité industrielle de HaloOS. Pour les constructeurs et équipementiers qui souhaitent adopter cet OS, l'élargissement de la compatibilité matérielle représente un argument décisif.

Le développement de HaloOS a débuté en 2021, mobilisant 200 ingénieurs et un investissement d'un milliard de yuans, soit environ 138 millions de dollars. Li Xiang, fondateur et PDG de Li Auto, a positionné les systèmes d'exploitation automobiles comme la plateforme centrale de la prochaine phase d'intelligence embarquée et comme le socle des futurs agents IA avancés. Dans un secteur où Tesla, Huawei et d'autres géants technologiques se disputent la maîtrise du logiciel embarqué, Li Auto mise sur l'open source pour fédérer un écosystème de partenaires et accélérer l'adoption de HaloOS au-delà de sa propre gamme de véhicules. Black Sesame, acteur montant des semi-conducteurs automobiles, trouve dans ce partenariat un levier pour imposer ses puces comme référence dans l'industrie automobile chinoise.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

L'IA physique soulève des questions de gouvernance pour les systèmes autonomes
1AI News 

L'IA physique soulève des questions de gouvernance pour les systèmes autonomes

La convergence de l'intelligence artificielle et des systèmes physiques pose des questions de gouvernance inédites pour les entreprises, les régulateurs et les ingénieurs. En 2024, la Fédération internationale de la robotique recensait 542 000 robots industriels installés dans le monde, soit plus du double du niveau enregistré dix ans plus tôt. Les projections tablent sur 575 000 unités en 2025 et plus de 700 000 d'ici 2028. Dans ce contexte, le marché de ce que les analystes appellent désormais la "Physical AI" -- robotique, edge computing et machines autonomes -- était estimé à 81,64 milliards de dollars en 2025 par Grand View Research, avec des projections atteignant 960,38 milliards en 2033. En mars 2025, Google DeepMind a franchi une étape concrète en lançant Gemini Robotics et Gemini Robotics-ER, deux modèles construits sur Gemini 2.0 et conçus pour le contrôle direct de robots et le raisonnement spatial. En avril 2026, une nouvelle version, Gemini Robotics-ER 1.6, a été mise en préversion via l'API Gemini, avec des capacités renforcées de planification de tâches, de détection de succès et de raisonnement par étapes intermédiaires. L'enjeu dépasse largement celui de l'automatisation logicielle classique. Lorsqu'un modèle de langage produit une réponse incorrecte, l'erreur reste dans le domaine informationnel. Lorsqu'un modèle piloté un robot, une sortie erronée peut se traduire par un mouvement physique dans un environnement partagé avec des humains ou connecté à des équipements industriels critiques. Google DeepMind identifie trois propriétés fondamentales pour des robots véritablement utiles : la généralité (capacité à traiter des objets et environnements inconnus), l'interactivité (adaptation aux instructions humaines et aux conditions changeantes), et la dextérité (précision des gestes physiques). Des systèmes comme Gemini Robotics peuvent suivre des instructions en langage naturel et exécuter des séquences complexes -- plier du papier, emballer des objets, manipuler des éléments jamais vus à l'entraînement. Mais cette même flexibilité complique la définition de limites de sécurité claires et de procédures d'arrêt d'urgence. Derrière la performance technique se profile un problème de gouvernance systémique encore non résolu. Contrairement aux logiciels, les systèmes physiques autonomes opèrent dans des espaces réels, soumis à des normes de sécurité industrielles, de responsabilité civile et de certification qui n'ont pas été conçues pour des agents capables de raisonner et de décider de façon autonome. La mise à disposition de Gemini Robotics-ER 1.6 via l'API Gemini rapproche le développement de ces systèmes des environnements de tests accessibles aux développeurs, mais transfère aussi une partie de la responsabilité vers les intégrateurs. Le secteur se retrouve face à une question centrale : qui valide, surveille et peut arrêter un agent physique lorsque son comportement s'écarte des limites prévues ? Les réponses réglementaires et industrielles à cette question seront déterminantes pour le déploiement à grande échelle de la Physical AI dans les prochaines années.

UELes industriels et régulateurs européens devront réviser les cadres de responsabilité civile, de certification et de sécurité des machines pour couvrir des agents physiques autonomes capables de raisonner, un vide que l'AI Act actuel n'adresse pas encore directement.

RobotiqueOpinion
1 source
Système ouvert de bout en bout pour la navigation autonome de robots en conditions réelles
2arXiv cs.RO 

Système ouvert de bout en bout pour la navigation autonome de robots en conditions réelles

Des chercheurs ont présenté un système embarqué léger et à architecture ouverte permettant à un robot quadrupède de naviguer de manière autonome dans des environnements réels, inconnus et dynamiques, sans apprentissage préalable spécifique à ces lieux. Déployé sur un robot Unitree Go2 à quatre pattes, le système atteint un taux de réussite supérieur à 88 % dans plusieurs environnements intérieurs testés. Il repose sur ROS2 comme middleware de communication entre les différents composants embarqués, et accepte des instructions de navigation formulées en langage naturel. Les capteurs du robot alimentent en continu un système de localisation et de cartographie, qui construit des graphes de scènes hiérarchiques enrichis de sémantique ouverte, c'est-à-dire capables d'identifier des objets sans liste prédéfinie. Un planificateur basé sur un grand modèle de langage (LLM) exploite ces graphes pour générer et adapter des plans d'action en temps réel, au fur et à mesure que la scène évolue. Ce résultat est significatif car la navigation autonome en environnement réel reste un problème difficile que la majorité des systèmes actuels ne résolvent qu'en simulation, là où les conditions sont contrôlées et les incertitudes absentes. Le fait qu'un robot puisse interpréter une consigne en langue naturelle, construire une représentation sémantique de son environnement à la volée et s'y adapter dynamiquement ouvre la voie à des déploiements pratiques dans des bâtiments industriels, des entrepôts, des hôpitaux ou des espaces publics, sans configuration manuelle préalable. La robotique autonome bute depuis des années sur quatre obstacles fondamentaux : la perception imparfaite, l'observabilité partielle, l'incertitude de localisation et les contraintes de sécurité. L'intégration des LLM comme couche de planification symbolique, combinée à une cartographie sémantique continue, représente une approche émergente qui capitalise sur les progrès récents en traitement du langage naturel et en vision par ordinateur. Ce travail s'inscrit dans une tendance plus large visant à doter les robots de capacités de raisonnement général plutôt que de comportements pré-programmés, un chantier sur lequel rivalisent des équipes académiques et des acteurs industriels comme Boston Dynamics, Figure AI ou Agility Robotics.

RobotiqueActu
1 source
Robbyant lance LingBot-VLA 2.0, un modèle VLA open source de 6 milliards de paramètres pour la manipulation robotique multi-morphologies
3MarkTechPost 

Robbyant lance LingBot-VLA 2.0, un modèle VLA open source de 6 milliards de paramètres pour la manipulation robotique multi-morphologies

Robbyant, filiale d'Ant Group, a publié LingBot-VLA 2.0, un modèle fondation de type Vision-Language-Action (VLA) destiné au contrôle de robots, accompagné d'un rapport technique, d'un code source sous licence Apache-2.0 et d'un checkpoint de 6 milliards de paramètres. Ce modèle, baptisé lingbot-vla-v2-6b, s'appuie sur Qwen3-VL-4B-Instruct comme backbone vision-langage et convertit des images de caméra ainsi qu'une instruction textuelle en commandes robotiques concrètes. Deux modèles enseignants, LingBot-Depth et DINO-Video, supervisent l'entraînement par distillation. Sur une carte graphique NVIDIA GeForce RTX 4090D, une inférence prend environ 130 millisecondes avec 10 étapes de débruitage. L'entraînement s'appuie sur environ 60 000 heures de données, dont 50 000 heures de trajectoires robotiques couvrant 20 configurations différentes, du bras unique à l'humanoïde complet, et 10 000 heures de vidéos égocentriques humaines, issues d'un pool brut de 90 000 et 20 000 heures respectivement, filtré par un pipeline qui élimine les échantillons bruités via des scores de secousse, vitesse et accélération. L'annotation des sous-tâches repose sur le modèle Qwen3.6-27B, qui segmente chaque vidéo selon un vocabulaire fermé de 18 catégories d'actions. L'enjeu central visé par Robbyant est de combler l'écart persistant entre les performances des modèles VLA en laboratoire et leurs limites en déploiement réel, un problème récurrent qui freine l'adoption industrielle de la robotique généraliste. En unifiant la représentation des actions dans un vecteur canonique de 55 dimensions, couvrant bras, effecteurs, mains, poignets, tête et base mobile, LingBot-VLA 2.0 permet à un seul modèle de piloter des architectures robotiques très différentes sans réentraînement spécifique. Cette approche pourrait accélérer le déploiement de robots polyvalents dans l'industrie et la logistique, en réduisant les coûts de développement liés à la création d'un modèle par type de robot. L'ouverture du code sous licence permissive vise aussi à stimuler la recherche communautaire sur les modèles VLA multi-embodiment. Le choix d'une architecture Mixture-of-Experts pour l'expert d'action, inspirée des mécanismes de routage sans perte d'équilibrage introduits par DeepSeek-V3, s'inscrit dans une tendance plus large de la recherche en IA visant à augmenter la capacité des modèles sans alourdir le calcul actif. À paramètres actifs équivalents, cette architecture MoE surpasse un modèle dense de référence sur les tâches du benchmark GM-100. LingBot-VLA 2.0 introduit également une distillation à double requête, avec des jetons apprenants ciblant l'observation présente et une observation future, pour anticiper la dynamique du monde plutôt que réagir seulement à l'instant présent. Ces choix technique reflètent la compétition croissante entre laboratoires chinois et occidentaux sur la robotique générale fondée sur des modèles fondation, un terrain où Ant Group cherche désormais à s'imposer aux côtés d'acteurs comme Figure, Physical Intelligence ou Google DeepMind.

💬 C'est le pattern qu'on va voir se répéter partout en robotique cette année : un seul modèle qui pilote bras, mains et humanoïde sans réentraînement par machine. Un vecteur d'action unifié à 55 dimensions, ça règle enfin le vrai problème, celui de devoir refaire un modèle à chaque nouveau robot. Reste que 130ms d'inférence sur une RTX 4090D, c'est loin d'être garanti stable en usine, et Ant Group arrive tard face à Figure ou Physical Intelligence sur ce terrain.

RobotiqueActu
1 source
La technologie bionique doit faire ses preuves hors des laboratoires
4IEEE Spectrum AI 

La technologie bionique doit faire ses preuves hors des laboratoires

Robert Woo est architecte et tétraplégique depuis un accident de chantier survenu en 2007. En 2011, lors de sa troisième session dans un exosquelette motorisé, il frappait déjà les esprits en parcourant une salle de rééducation avec un prototype encombrant. Quinze ans plus tard, il testait à Manhattan un nouveau modèle autoéquilibrant du fabricant français Wandercraft, capable de le maintenir debout sans béquilles. Parallèlement, les interfaces cerveau-machine, ou BCI, font l'objet d'essais cliniques permettant à des patients paralysés de contrôler des bras robotiques ou de communiquer par la pensée. C'est dans ce contexte qu'IEEE Spectrum a consacré un dossier spécial intitulé "Cyborg Tech From the Inside", accompagné de la création de la Taenzer Fellowship, une bourse de journalisme attribuée à six journalistes en situation de handicap qui couvrent les technologies qu'ils utilisent eux-mêmes au quotidien. Ce qui ressort de ces reportages, c'est l'écart persistant entre la démonstration maîtrisée et l'usage réel. Lors du test new-yorkais, une pente d'à peine quelques millimètres sur le trottoir de Park Avenue a suffi à déclencher les capteurs de sécurité du Wandercraft, immobilisant Woo sur place. Cet incident illustre un problème structurel : les technologies bioniques sont évaluées sur ce qu'elles réussissent une fois, devant une caméra, et non sur ce qu'elles tiennent sur la durée, dans des conditions ordinaires et imprévisibles. Pour les utilisateurs, le vrai critère n'est pas l'exploit ponctuel, mais la fiabilité au centième essai, dans un couloir étroit, sous la pluie, ou face à un seuil de porte. La couverture médiatique des technologies d'assistance souffre depuis des années de ce que les critiques appellent le "techno-solutionnisme" : une tendance à présenter les percées technologiques comme des solutions prêtes à l'emploi, en occultant les frictions du monde réel. Robert Woo incarne une autre approche : en testant et en documentant ces systèmes depuis 2011, ses retours ont alimenté des améliorations incrémentales concrètes. Les pionniers des BCI, eux, sont comparés aux premiers astronautes, ceux qui ont à peine effleuré l'espace avant de redescendre sur Terre. Ces utilisateurs ne sont pas de simples patients passifs ; ils fonctionnent comme bêta-testeurs et co-ingénieurs de technologies encore immatures. L'enjeu des prochaines années sera de faire passer ces systèmes de l'exploit de laboratoire à l'intégration fluide dans une vie ordinaire, avec toutes ses aspérités.

UEWandercraft, fabricant français d'exosquelettes, est au cœur de l'article, ses limites en conditions urbaines réelles soulèvent des enjeux de certification et de déploiement commercial qui concernent directement l'industrie française des technologies d'assistance.

RobotiqueOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic