Aller au contenu principal
Outils · Outil ·

Together Link : un outil CLI gratuit pour utiliser des modèles ouverts comme Kimi K3 et GLM 5.3 dans Claude Code, Codex et OpenCode

Together AI a lancé Together Link, un outil en ligne de commande gratuit, sous licence MIT et actuellement en version bêta. Il relie les agents de programmation que les développeurs utilisent déjà (Claude Code, Claude Desktop, Codex, ChatGPT Desktop, OpenCode et Pi) aux modèles ouverts hébergés par Together AI. L'installation tient en une commande curl sur macOS ou Linux et ne demande qu'une clé API Together. Les commandes, le routage et la liste des modèles peuvent encore changer. Le catalogue comprend Kimi K3, GLM 5.3, GLM 5.3 Flash et DeepSeek V4.1 Flash, tous avec un contexte d'un million de jetons. Les tarifs affichés sont de 3 dollars en entrée et 15 dollars en sortie par million de jetons pour Kimi K3, et de 1,40 et 4,40 dollars pour GLM 5.3. DeepSeek V4.1 Flash et MiniMax M3 sont à 0,30 et 1,20 dollar.

2 min de lecturePertinence 52

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de MarkTechPost. Lire l'article original →

Le fonctionnement repose sur une architecture sans proxy local ni démon : chaque outil dialogue directement avec la passerelle hébergée de Together. Les agents en terminal reçoivent une configuration temporaire, effacée à la fin de la session, tandis que les applications de bureau utilisent des profils réversibles. Par défaut, un modèle virtuel « auto » lit la première tâche de la session et envoie les corrections rapides vers des modèles économiques, les problèmes difficiles vers des modèles de pointe. Avec une clé Anthropic, il arbitre entre Opus 5.5 et GLM 5.3, uniquement dans Claude Code et Claude Desktop. Sans clé, il choisit entre GLM 5.3 et GLM 5.3 Flash. Le routage n'intervient qu'une fois par session, ce qui préserve le cache de prompts. Chaque session affiche ses totaux en jetons et en dollars à la sortie, et la ligne d'état de Claude Code compare la dépense estimée au coût équivalent d'Opus.

L'enjeu est financier. Selon Together, les équipes d'ingénierie dépensent de dizaines de milliers à plusieurs millions de dollars par mois en modèles fermés, alors que chaque tâche, d'une correction d'une ligne à une réécriture complète, est souvent envoyée au même modèle premium. Garder l'outil, changer le modèle et surveiller la facture permet de réduire ce poste sans quitter ses habitudes de travail. La commande togetherlink usage --last 7d donne une vue du coût cumulé sur plusieurs sessions, ce qui aide à mesurer l'économie réelle. Dans Claude Code, le menu /model associe Opus à Kimi K3, Fable à GLM 5.3, Sonnet à GLM 5.3 Flash et Haiku à DeepSeek V4.1 Flash.

Cette sortie s'inscrit dans la montée en puissance des modèles ouverts pour le code, dont Together estime qu'ils ont comblé une bonne part de l'écart avec les modèles fermés. L'entreprise affirme aussi servir la plus grande part des jetons d'OpenRouter pour DeepSeek V4.1 Flash (40,8 %), GLM 5.3 Flash (28,2 %) et Kimi K3 (23,1 %), au 30 septembre 2026. Le marché des passerelles est déjà occupé : OpenRouter, Claude Code Router, qui exécute une passerelle locale sur le port 3456, et la commande « ollama launch » proposent des approches voisines. Together Link se distingue par une installation en une ligne, l'absence de proxy local et un routeur automatique intégré. Reste à voir si la bêta tiendra ses promesses d'économies à grande échelle.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

Notre lecture

Le vrai sujet, c'est que la facture IA du code devient un poste qu'on pilote, comme le cloud. Together Link ne vend pas un meilleur modèle, il vend l'idée qu'envoyer une correction d'une ligne vers un modèle premium, c'est du gaspillage. Le routeur « auto » qui tranche une seule fois par session pour garder le cache, c'est malin. Bon, sur le papier. Reste à voir si ça tient en prod, parce que les chiffres de part de marché viennent de Together lui-même, et un routeur qui se trompe sur la difficulté d'une tâche te coûte du temps, pas juste des jetons.

À lire ensuite

01Utiliser des modèles à poids ouverts pour coder avec l'IA via Amazon Bedrock39AWS ML BlogOutils 02Les développeurs trouvent des moyens d'utiliser Claude Code sans les modèles d'Anthropic43The Information AIOutils 03Le « Claude-Killer » est là : OpenAI dévoile un Codex pour (presque) tout52Le Big DataOutils 
Dossier · Claude CodeSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.