Voir la présentation officielle
La vidéo ci-dessous, publiée par la chaîne YouTube vérifiée Claude, présente le lancement. Elle dure 13 secondes ; elle sert d’illustration et ne remplace pas les données techniques et les conditions détaillées dans cet article. Vidéo officielle sur YouTube.
Quelle place Sonnet 5.5 occupe-t-il dans la gamme Claude ?
Anthropic positionne Sonnet 5.5 comme le modèle de travail courant de sa famille 5.5. Il suit Opus 5.5, annoncé le 22 septembre, qui reste présenté comme le choix le plus solide pour les travaux complexes et ouverts exigeant un jugement prolongé. Sonnet vise les tâches mieux délimitées : corriger un bug, itérer rapidement sur du code, rédiger ou retravailler des documents, construire des présentations et exploiter des tableurs. Haiku 5.5 est annoncé pour les semaines suivantes ; il ne faut donc pas le présenter comme disponible aujourd’hui. Annonce Sonnet 5.5 ; annonce Opus 5.5.
Cette segmentation répond à une question très concrète. Une équipe qui choisit systématiquement son modèle le plus puissant peut payer plus et attendre davantage sur des opérations simples. À l’inverse, employer le plus rapide sur une enquête technique incertaine peut imposer plus de vérifications humaines ou plusieurs reprises. Anthropic propose ainsi un arbitrage entre qualité, latence et coût. Il ne s’agit pas d’une garantie que Sonnet 5.5 remplacera Opus 5.5 dans tous les flux de travail : le fournisseur écrit lui-même qu’Opus conserve l’avantage sur les tâches complexes et ouvertes. Comparaisons publiées par Anthropic.
Le prix : pas de baisse par million de tokens
Sur la Claude API, Anthropic affiche 2 dollars pour un million de tokens d’entrée et 10 dollars pour un million de tokens de sortie, soit les mêmes prix standards que Sonnet 5. Les lectures de cache sont indiquées à 0,20 dollar par million de tokens. La fiche technique précise également 2,50 dollars pour un million de tokens écrits dans un cache de cinq minutes, 4 dollars pour un cache d’une heure et une remise de 50 % sur les entrées et sorties via Batch API. Ces montants sont des prix API en dollars : ils ne décrivent ni un abonnement Claude, ni nécessairement la facturation d’un revendeur cloud. Prix officiels ; comparaison publiée par Anthropic.
Pourquoi Anthropic parle-t-il alors d’un modèle « moins cher » ? Son argument est qu’une tâche comparable demanderait moins de tokens ou d’appels d’outils. Dans ses tests, l’économie peut atteindre 30 % par tâche. Le gain dépendra de l’usage réel, du niveau d’effort retenu, de la part du cache et du nombre de tentatives nécessaires. Un service générant surtout de longues réponses peut observer un bilan très différent d’un agent qui résout vite un problème avec peu d’étapes. Pour piloter un budget, la bonne mesure est donc le coût d’un résultat validé, pas seulement le tarif au million de tokens. Méthodologie et prix d’Anthropic.
Vitesse et performances : des progrès à replacer dans leur contexte
Anthropic annonce une génération des sorties plus de 30 % plus rapide que Sonnet 5. La société publie aussi un score de 70,6 % sur Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5 dans son tableau de lancement. Sur CursorBench 4.0, le nouveau modèle est donné à 55,5 %, contre 34,1 % pour Sonnet 5. Ces chiffres sont intéressants pour les utilisateurs d’agents de programmation, car ils portent sur des tâches plus proches d’un usage avec outils qu’un simple questionnaire. Ils restent des résultats de tests définis et sélectionnés ; ils ne garantissent pas la même progression dans chaque dépôt de code. Résultats et notes méthodologiques d’Anthropic.
Il serait également excessif d’en conclure que Sonnet 5.5 « bat Opus 5.5 partout ». Sur certains bancs d’essai, Sonnet atteint ou dépasse une valeur isolée d’Opus, mais Anthropic précise que le niveau d’effort, le coût par tâche et la nature de l’exercice modifient la comparaison. La société signale même un résultat moins bon à l’effort maximal qu’à un effort légèrement inférieur sur FrontierCode, car certains comportements ont allongé ou élargi les modifications au-delà du périmètre demandé. Ce cas rappelle qu’un agent plus actif n’est pas forcément un agent plus efficace. Tableaux et notes d’Anthropic.
Pour les responsables techniques, le meilleur test reste un jeu de tâches représentatives de leur propre activité : bugs réellement rencontrés, documents internes, contraintes de confidentialité et critères de validation identiques pour chaque modèle. Un benchmark public oriente un essai ; il ne décide pas à lui seul d’un achat ou d’une migration. Cette recommandation est une analyse éditoriale, fondée sur la forte variabilité des niveaux d’effort et des tests décrite par Anthropic. Documentation du modèle.
Un modèle disponible, mais une migration qui demande quelques vérifications
Le nom de modèle à appeler sur la plateforme Claude est claude-sonnet-5-5. Anthropic indique une disponibilité via sa propre plateforme, Amazon Bedrock, Google Cloud et Microsoft Azure. AWS confirme séparément l’accès par Bedrock et par Claude Platform on AWS ; pour un besoin de résidence des données, il faut vérifier les régions précises disponibles chez chaque hébergeur. La fiche officielle annonce une fenêtre de contexte de un million de tokens et une sortie maximale de 128 000 tokens dans la configuration courante ; ces maxima techniques ne garantissent ni qualité constante sur un document entier, ni éligibilité identique sur toutes les offres. Annonce Anthropic ; confirmation AWS.
Les développeurs ne devraient pas seulement remplacer le nom du modèle dans leur code. La documentation recense des changements incompatibles avec certains usages de Sonnet 5, notamment une nouvelle manière de désactiver la réflexion initiale grâce au paramètre between_tools, des différences avec l’usage forcé d’outils, le rattachement des blocs de réflexion à une conversation et l’abandon d’une ancienne version de l’outil de contrôle d’ordinateur dans certaines API. Les applications qui supposent que le premier bloc de réponse est toujours du texte peuvent aussi devoir être adaptées, puisque la réflexion est active par défaut. Guide de migration et liste des changements ; guide de développement Claude.
Sécurité : des garde-fous renforcés, sans promesse de risque zéro
Anthropic dit avoir testé Sonnet 5.5 sur environ 1 850 scénarios d’audit comportemental. La société affirme qu’il égale ou améliore Sonnet 5 sur la plupart des mesures étudiées, tout en reconnaissant qu’aucun ensemble de tests ne peut détecter toutes les défaillances possibles. Les conclusions restent donc celles du laboratoire, dans le périmètre de ses évaluations publiées. Présentation sécurité d’Anthropic.
La progression des capacités cyber conduit Anthropic à appliquer à Sonnet 5.5 des garde-fous comparables à ceux de modèles plus puissants : certaines demandes à risque élevé peuvent basculer visiblement vers Sonnet 5. Les protections biologiques demeurent celles de Sonnet 5, avec un risque annoncé de refus à tort pour certains travaux de microbiologie ou de virologie. Pour un professionnel, cela signifie qu’un gain de performance affiché ne sera pas accessible de façon uniforme sur toutes les catégories de demandes. Détail officiel des garde-fous.
Ce qu’il faut retenir avant de changer de modèle
Sonnet 5.5 apporte une nouvelle option crédible pour les tâches répétées où comptent simultanément la qualité, la latence et le coût. La baisse de prix par token n’existe pas : le bénéfice financier avancé par Anthropic repose sur une meilleure efficacité dans certaines tâches. Les benchmarks justifient un essai sérieux, mais pas une conclusion universelle sur la supériorité du modèle. La migration nécessite aussi des vérifications techniques et de sécurité. Pour les utilisateurs de Claude, c’est une évolution importante de la gamme ; pour les entreprises, le verdict viendra de leurs propres mesures, sur leurs propres tâches. Annonce officielle ; documentation technique.

