Aller au contenu principal
Outils · Outil ·

Architect lance Liquid Inference, une enchère en temps réel pour l'inférence de LLM

Architect Financial Technologies, la société derrière la bourse de contrats perpétuels AX, a lancé Liquid Inference, un routeur de requêtes pour grands modèles de langage qui organise une enchère en direct pour chaque prompt. Les fournisseurs d'inférence publient des offres pour servir des modèles précis. Chaque requête est mise aux enchères entre tous les fournisseurs qui cotent le modèle demandé, et l'offre la moins chère qui respecte les règles de l'acheteur l'emporte. Le client envoie un appel standard au format OpenAI ou Anthropic, ses contraintes filtrent les offres éligibles, puis le prix maximal est verrouillé avant la génération et seule la consommation mesurée est facturée. L'acheteur peut fixer un plafond de coût par tâche, une limite de délai avant le premier token, un débit minimal, des régions autorisées, l'absence de conservation des données, ainsi que des listes de fournisseurs ou de modèles. Un mode Auto peut choisir le modèle selon l'unité de travail. Les inscrits, gratuits par email, peuvent consulter les carnets d'ordres en direct, les cotations par fournisseur et par modèle, et les transactions conclues. Les 500 premiers utilisateurs reçoivent 20 dollars d'inférence gratuite, et un programme de parrainage reverse 20 % des frais des filleuls en inférence gratuite, plus 10 % sur le second niveau.

2 min de lecturePertinence 43

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de MarkTechPost. Lire l'article original →

Pour les développeurs, le changement tient en peu de chose : remplacer l'URL de base, conserver son code et laisser les fournisseurs se concurrencer sur le prix. Liquid Inference est compatible avec des outils de codage agentique comme Claude Code, Codex, OpenCode, Cursor, Pi et Cline. Côté fournisseurs, l'intérêt est de monétiser de la capacité GPU inutilisée à la demande : ils s'enregistrent via l'application, sont vérifiés « en minutes, pas en semaines » selon Harrison, déclarent leurs modèles et cotations par une API REST et WebSocket, et ajustent leurs prix en fonction de leurs propres coûts. Les paiements passent par Stripe, avec un relevé détaillé de chaque tâche. Face à OpenRouter, qui répartit la charge selon l'inverse du carré du prix et revendique plus de 500 modèles et 80 fournisseurs, ou à Hugging Face Inference Providers, qui privilégie par défaut le fournisseur le plus rapide, Liquid Inference se distingue par la transparence des données de marché, rare dans l'univers des API de LLM.

Le produit vient d'une société de trading plutôt que d'un laboratoire d'IA. Architect exploite la bourse AX de contrats perpétuels et a acquis en mai 2026 un marché désigné de contrats aux États-Unis afin de coter des contrats à terme sur la puissance de calcul GPU, sous réserve de l'examen réglementaire. L'équipe applique son expérience des bourses financières à la découverte des prix de l'inférence, des deux côtés du marché. Plusieurs points restent flous : les frais de plateforme, la liste des fournisseurs et les données de latence ne sont pas publics, et la société parle seulement de « centaines » de modèles. La suite dépendra de la profondeur de liquidité réellement atteinte et de l'avancée du projet de contrats à terme sur le calcul.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01APIs d'inférence à latence minimale pour la voix et les agents temps réel : un benchmark axé sur le TTFT40MarkTechPostOutils 02OpenAI lance Presence, une plateforme pour créer et gérer des agents vocaux et chatbots en temps réel44VentureBeat AIOutils 03AWS lance Pizza Bot, une boîte de réception open source pour agents IA en arrière-plan35MarkTechPostOutils 
Dossier · Hugging FaceSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.