Aller au contenu principal
LLMs · Actu ·

Liquid AI lance LFM2.5-2.6B, un modèle IA pour agents autonomes sur appareils légers comme le Raspberry Pi

La startup Liquid AI, fondée en 2023 par d'anciens chercheurs du MIT, a dévoilé cette semaine LFM2.5-2.6B, un modèle de langage à poids ouverts conçu pour les tâches agentiques. Il compte 2,6 milliards de paramètres, gère une fenêtre de contexte de 128 000 tokens et intègre l'appel d'outils natif. Disponibles sur Hugging Face, la version post-entraînée et le checkpoint de base LFM2.5-2.6B-Base sont compatibles dès leur sortie avec llama.cpp, MLX, vLLM, SGLang et ONNX. Selon Liquid AI, le modèle atteint environ 220 tokens par seconde sur une puce Apple M5 Max, 113 tokens par seconde sur un processeur AMD Ryzen AI Max+ 395, en consommant moins de 2,5 Go de mémoire, et environ 30 tokens par seconde sur smartphone via l'application Apollo. Sur un GPU Nvidia H100, l'entreprise revendique près de 15 000 tokens par seconde, soit environ 1,3 milliard de tokens par jour et par carte, des chiffres non vérifiés de façon indépendante.

2 min de lecturePertinence 42

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Sa particularité: fonctionner entièrement en local, sur smartphone, ordinateur portable ou même un Raspberry Pi, sans cloud ni GPU. Selon Maxime Labonne, responsable du post-entraînement chez Liquid AI, l'architecture LFM2 a été conçue autour des performances réelles sur CPU plutôt que sur les benchmarks GPU classiques. Cette approche ouvre l'IA en périphérie aux entreprises de secteurs régulés ou manipulant des données sensibles qu'elles refusent d'envoyer vers le cloud, et permet à toute entreprise de faire tourner des agents spécialisés au simple coût de l'électricité consommée. Le modèle vise les tâches agentiques à fort volume et bien définies: appel d'outils, gestion documentaire, automatisation d'agendas et de flux de travail, routines en arrière-plan, ainsi que les environnements à connectivité limitée comme les véhicules ou la robotique. Les tâches de programmation intensive restent, elles, réservées aux modèles plus volumineux.

Liquid AI ne présente pas LFM2.5-2.6B comme un concurrent des plus grands modèles frontières, mais défend l'idée qu'un petit modèle suffisamment performant peut ouvrir des usages d'entreprise où la latence, la confidentialité ou le coût d'inférence comptent plus que les scores de benchmarks. "Les meilleurs modèles resteront dans le cloud, et ce n'est pas un problème", a déclaré Maxime Labonne. "Nous voulons créer des modèles pour un autre type d'utilisateur: il faut utiliser l'IA en périphérie quand on ne peut pas utiliser un modèle cloud." Cette course aux modèles compacts est aussi portée par d'autres acteurs, comme Moonshot avec Kimi K3. Un point mérite l'attention des juristes: comme Kimi K3, LFM2.5-2.6B est distribué sous une licence de poids ouverts personnalisée, dont les termes devront être examinés avant tout déploiement commercial.

Impact France / UEChamp produit par Le Fil IA

Le fonctionnement local sans cloud pourrait intéresser les entreprises européennes de secteurs régulés soumises à des exigences de souveraineté des données, mais aucune entité française ou européenne n'est directement concernée.

Notre lecture

Ce qui compte ici, c'est pas les 2,6 milliards de paramètres, c'est qu'un modèle tourne enfin en local sans GPU, sur un Raspberry Pi ou un smartphone. L'IA en périphérie devient une option sérieuse pour les entreprises qui doivent garder leurs données chez elles, pas juste un exercice de miniaturisation. Bon, sur le papier : pour du code ou des tâches complexes, il faudra encore repasser par le cloud, mais pour de l'automatisation à la chaîne, ça peut vraiment remplacer un abonnement API.

À lire ensuite

01Liquid AI lance LFM2.5-2.6B, un modèle embarqué à base d'agents avec contexte 128K, appels d'outils et poids ouverts36MarkTechPostLLMs 02Liquid AI lance LFM2.5-VL-3B, un modèle vision-langage de 3 milliards de paramètres qui lit les écrans et appelle des outils sur l'appareil40MarkTechPostLLMs 03Liquid AI lance LFM2.5-230M avec support llama.cpp, MLX, vLLM, SGLang et ONNX pour l'inférence sur appareil45MarkTechPostLLMs 
Dossier · Moonshot AISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.