OpenAI GPT-5.6 Sol, Terra et Luna désormais disponibles sur Amazon Bedrock
Voici l'article traduit et résumé:
OpenAI a annoncé la disponibilité générale de trois nouveaux modèles, GPT-5.6 Sol, Terra et Luna, sur Amazon Bedrock, dans un article co-écrit avec Chris Dickens d'OpenAI. Cette famille de modèles introduit un système de nomenclature où le chiffre 5.6 désigne la génération tandis que les noms Sol, Terra et Luna correspondent à des niveaux de capacité durables, pouvant évoluer selon leur propre calendrier. Sol est le modèle phare optimisé pour le codage autonome, la recherche en sécurité, l'analyse scientifique et le raisonnement multi-étapes complexe, disponible dans les régions AWS US East Virginie du Nord et US East Ohio. Terra équilibre performance et coût pour les charges de travail de production courantes, tandis que Luna cible l'inférence rapide et économique pour des tâches comme la classification, le résumé ou le routage ; ces deux derniers sont également accessibles depuis US West Oregon. Les trois modèles acceptent texte et image en entrée, produisent du texte en sortie, disposent d'une fenêtre de contexte de 272 000 tokens et sont accessibles via l'API Responses d'OpenAI sur le point de terminaison bedrock-mantle, à l'adresse https://bedrock-mantle.{région}.api.aws.
Cette annonce répond à une demande claire des développeurs qui construisent des agents de codage autonomes, des systèmes de raisonnement long terme ou des applications d'inférence à haut volume : pouvoir appeler des modèles de pointe via des API familières sans avoir à gérer une infrastructure de modèles séparée. En intégrant GPT-5.6 directement à Bedrock, AWS permet aux équipes de basculer une application OpenAI existante vers son infrastructure en changeant simplement l'URL de base et en s'authentifiant avec une clé API Bedrock ou des identifiants AWS, sans réécrire leur intégration. La tarification correspond aux tarifs directs d'OpenAI et l'usage s'impute sur les engagements AWS déjà souscrits par les entreprises, ce qui simplifie la gestion budgétaire pour les équipes déjà clientes d'AWS.
Sur le plan de la sécurité et de la conformité, chaque appel de modèle s'exécute sous les politiques IAM du client, à l'intérieur de son VPC, et est journalisé dans AWS CloudTrail. L'inférence reste dans la région AWS spécifiée, un point important pour les organisations soumises à des exigences de résidence des données. OpenAI précise que les prompts et réponses ne servent pas à l'entraînement des modèles et ne sont pas partagés avec le fournisseur, sauf activation volontaire par le client. Le trafic signalé par les classificateurs de détection d'abus peut néanmoins être conservé jusqu'à 30 jours à des fins d'analyse automatisée hors ligne, une politique de rétention que les utilisateurs peuvent configurer eux-mêmes.
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.



