Chez Anthropic, Haiku 5.5 prend la relève des petits modèles rapides
Anthropic a présenté le 7 octobre Haiku 5.5, nouvelle version de son « petit modèle », qu'elle met en avant comme son modèle le moins cher, le plus rapide et le plus capable. Il vise les tâches à fort volume (résumés, compaction, requêtes de bases de données, classification) et peut servir de sous-agent pour Opus 5.5 ou Sonnet 5.5. Il cible aussi les usages sensibles à la latence, comme l'assistance client et le pilotage de navigateur. Près d'un an s'est écoulé depuis Haiku 4.5, sans version 5 intermédiaire. La fenêtre de contexte passe de 200 000 à un million de tokens, et la sortie maximale de 64 000 à 128 000. Le modèle reçoit pour la première fois un réglage d'effort, positionné sur « Moyen » par défaut. Les tarifs sont de 0,10 dollar par million de tokens en entrée et 0,50 dollar en sortie, mais seulement pour les requêtes de moins de 100 000 tokens. Au-delà, les prix sont multipliés par 5, tout en restant inférieurs en moyenne de moitié à ceux de Haiku 4.5. Anthropic indique que 90 % des requêtes adressées à Haiku 4.5 étaient sous ce seuil.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Next INpact. Lire l'article original →
Les progrès affichés sont spectaculaires : 39,2 % sur Terminal-Bench 4.0 contre 0 pour Haiku 4.5, 72,4 % contre 15,7 % sur OSWorld 2.1, 46,4 % contre 6,4 % sur Chartography, et 1 620 contre 735 sur GDPval-AA v2.1. Mais ces scores sont tous obtenus à l'effort maximal. Avec le réglage par défaut, le résultat sur Terminal-Bench 4.0 tombe à 20,3 %, soit à peu près la moitié. La baisse de prix est donc réelle mais conditionnelle. Selon Artificial Analysis, Haiku 5.5 est plus verbeux que son prédécesseur, et sa facture dépend du niveau d'effort choisi. Le testeur indépendant relève néanmoins un coût par tâche systématiquement plus avantageux que celui de l'ancien Haiku. Pour les développeurs, l'enjeu est de calibrer l'effort selon la tâche, au lieu de se fier aux chiffres vitrines.
Le modèle reste loin de ses grands frères. Sur FrontierCode 1.1, Haiku 5.5 atteint 46,4 %, contre 52,1 % pour Sonnet 5.5 en effort Xhigh, un écart de moins de 6 points. Sur Terminal-Bench 4.0, en revanche, Sonnet 5.5 monte à 70,6 % (niveau d'effort non précisé), contre 39,2 % pour Haiku. Anthropic reconnaît que ces comparaisons ne servent que de référence : Haiku 5.5 convient surtout aux tâches étroites qui auraient été coûteuses avec les versions précédentes de Claude, comme la compaction ou la synthèse. Le lancement s'inscrit aussi dans la bataille des prix avec OpenAI. Anthropic compare Haiku 5.5 à GPT-6 Luna et se dit plus avantageux. La comparaison est toutefois nuancée, car la majoration tarifaire de Luna n'intervient qu'à 272 000 tokens, contre 100 000 pour Haiku. La concurrence entre les deux laboratoires se joue désormais autant sur le segment des petits modèles économiques que sur celui des modèles de pointe, aux côtés de Claude Opus 5.5 et de GPT-6 Sol.
Pas d'impact direct sur la France/UE