Aller au contenu principal
LLMs · Actu ·

Claude Sonnet 5 d'Anthropic réduit l'écart avec la gamme Opus, plus chère

Anthropic a dévoilé Claude Sonnet 5, la dernière évolution de sa gamme de modèles de langage. Selon l'entreprise, ce nouveau modèle surpasse son prédécesseur, Sonnet 4.6, sur l'ensemble des benchmarks utilisés pour l'évaluer. Fait notable, Sonnet 5 devance même Opus 4.8, le modèle haut de gamme et plus coûteux de la même famille, sur le test GDPval-AA v2, qui évalue les compétences en travail de connaissance : il y obtient un score de 1 618 points. Anthropic précise également que Sonnet 5 affiche des résultats nettement inférieurs, sur les tâches liées à la cybersécurité, à ceux des modèles que le gouvernement américain a actuellement interdits pour ce type d'usage.

1 min de lecturePertinence 43

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Cette annonce a une portée qui dépasse la simple mise à jour technique. En rattrapant, voire en dépassant sur certains critères, un modèle plus onéreux, Sonnet 5 permet aux entreprises et développeurs d'obtenir des performances de premier plan à moindre coût, ce qui pourrait redistribuer les usages entre les différentes gammes de modèles d'Anthropic. La mention explicite des scores en cybersécurité n'est pas anodine : elle intervient alors que les autorités américaines examinent de près les capacités offensives de l'intelligence artificielle et envisagent de restreindre l'accès à certains modèles jugés trop performants dans ce domaine.

Ce positionnement s'inscrit dans un contexte plus large de compétition entre laboratoires d'IA, où chaque nouvelle génération de modèle cherche à combiner puissance et maîtrise des risques. En insistant sur le fait que Sonnet 5 reste loin des seuils jugés problématiques par Washington, Anthropic cherche à démontrer sa capacité à proposer des modèles à la fois performants et conformes aux exigences réglementaires émergentes, dans un débat toujours en cours sur l'encadrement des IA les plus avancées.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Claude Sonnet 5.5 : Anthropic lance un modèle plus rapide et moins cher, presque au niveau d’Opus 5.561FrandroidLLMs 02Claude Sonnet 5 arrive sur AWS : le modèle Sonnet le plus performant d'Anthropic42AWS ML BlogLLMs 03Claude Opus 5.5, GPT-6 Sol et Luna : Anthropic et OpenAI se battent sur les prix54Next INpactLLMs 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.