Moins d’une semaine après Opus 5.5 et dans la foulée des GPT-6 Sol et Luna d’OpenAI, Anthropic dégaine Sonnet 5.5, un modèle intermédiaire pensé pour les tâches du quotidien.
Introduction
Le calendrier des grands acteurs de l’intelligence artificielle ne laisse plus beaucoup de répit. OpenAI a publié GPT-6 Sol et Luna la semaine dernière, Meta a annoncé un nouveau modèle destiné à alimenter une fonctionnalité de ses lunettes connectées, et voilà qu’Anthropic remet le couvert avec Claude Sonnet 5.5, deuxième représentant de la famille Claude 5.5, moins d’une semaine après Opus 5.5. Rappelons que son prédécesseur, Sonnet 5, avait été annoncé il y a environ trois mois seulement.
Le positionnement est néanmoins assumé. Là où Opus 5.5 vise les travaux complexes qui réclament un jugement fin, Sonnet 5.5 se présente comme un complément plus abordable, taillé pour les tâches quotidiennes bien délimitées, comme la correction de bugs ou la production de documents, de diapositives et de feuilles de calcul.
Plus rapide, moins cher, sans prétendre repousser les limites
Anthropic ne joue pas la carte de l’esbroufe. L’entreprise reconnaît elle-même que « Sonnet 5.5 ne fait pas progresser la frontière des capacités de nos modèles ». Le gain se situe ailleurs, dans l’efficacité. Le modèle génère ses sorties au moins 30 % plus rapidement que Sonnet 5 et, selon Anthropic, revient jusqu’à 30 % moins cher que son prédécesseur pour la plupart des tâches, alors même que la grille tarifaire reste inchangée. Autrement dit, le modèle consommerait moins pour un résultat équivalent, sans que les conditions exactes de cette économie soient détaillées.

Côté performances, les chiffres avancés par l’entreprise placent le nouveau venu très près de son grand frère. Sur GDPval-AA v2.1, un benchmark qui évalue le travail réel sur 44 métiers, Sonnet 5.5 décroche un score de 1 844, soit deux petits points derrière Opus 5.5 et environ 400 points devant Sonnet 5. Il ferait même mieux qu’Opus 5.5 sur le codage agentique, toujours selon les benchmarks maison. Anecdote plus ludique, c’est le premier modèle Sonnet à venir à bout de Pokémon Red en travaillant uniquement à partir de captures d’écran.
Des garde-fous hérités d’Opus
Sur le terrain de la sécurité, Sonnet 5.5 inaugure plusieurs premières pour la gamme. C’est le premier modèle Sonnet soumis aux mêmes protections cybersécurité que les modèles Opus. Concrètement, les requêtes à risque élevé dans ce domaine seront redirigées de manière visible vers Sonnet 5, tandis que la correction de bugs courante n’est pas concernée. C’est aussi le premier Sonnet à embarquer des classificateurs conçus pour bloquer les attaques par distillation, ces tentatives d’extraction des capacités d’un modèle pour en entraîner un autre.

Anthropic précise qu’aucune nouvelle barrière de sécurité n’a été ajoutée par rapport à l’existant. Lors d’un audit comportemental automatisé portant sur environ 1 850 scénarios, le modèle a égalé ou amélioré Sonnet 5 sur la plupart des mesures d’alignement. Signalons qu’il s’est aussi montré le moins enclin, parmi tous les modèles testés en interne, à rechercher activement des vulnérabilités dans son bac à sable de test.
Disponible partout, Haiku en approche
Sonnet 5.5 est accessible dès maintenant sur l’ensemble des plateformes Anthropic, ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure. Les développeurs peuvent l’appeler via l’API sous l’identifiant claude-sonnet-5-5, avec zéro rétention de données. Petit détail technique qui a son importance, ceux qui utilisent Sonnet avec la réflexion désactivée devront d’abord adopter le nouveau paramètre between_tools avant de migrer.
Reste la question du tarif. Sonnet 5.5 est facturé 2 dollars par million de tokens en entrée, 10 dollars par million en sortie et 0,20 dollar par million pour les lectures de cache, des prix identiques à ceux de Sonnet 5 et moitié moindres que ceux d’Opus 5.5. La famille Claude 5.5 accueillera sans aucun doute son troisième membre, Claude Haiku 5.5, dans les prochaines semaines, sans date précise annoncée à ce stade.