Anthropic lance Claude Sonnet 5.5, son nouveau modèle d’intelligence artificielle de niveau intermédiaire conçu pour les tâches quotidiennes, le développement et la création de documents. Ce modèle conserve le prix de Claude Sonnet 5 tout en générant des réponses plus de 30 % plus rapidement et en réduisant le coût de certaines tâches jusqu’à 30 %.

Un gain clair en vitesse et en programmation
Claude Sonnet 5.5 succède à Sonnet 5, lancé en juin, et complète Opus 5.5, le dernier modèle d’IA haut de gamme d’Anthropic. L’entreprise l’utilise notamment pour le débogage, la création de présentations et de tableurs, ainsi que pour des tâches nécessitant plusieurs étapes, sans exiger le niveau de raisonnement associé à Opus.
Les premiers benchmarks publiés par Anthropic montrent une progression significative en programmation. Claude Sonnet 5.5 a obtenu un score de 70,6 % dans le Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5, et un score de 55,5 % dans le CursorBench 4.0, en hausse par rapport aux 34,1 % de son prédécesseur. Sur FrontierCode, il atteint 46,2 % au niveau d’effort maximal et 52,1 % avec Xhigh, alors que Sonnet 5 était à 42,4 %.

Anthropic met particulièrement en avant la relation entre performance et coût. Lors de plusieurs tests, Claude Sonnet 5.5 a dépassé le meilleur résultat de Sonnet 5 à un niveau d’effort faible ou moyen d’environ un dixième du coût par tâche. Dans FrontierCode, son niveau d’effort élevé affiche 10 points de plus que Sonnet 5 dans les mêmes conditions, tout en coûtant environ 15 fois moins par tâche.
Le modèle conserve les tarifs de Sonnet 5 : 2 $ par million de tokens entrants, 10 $ par million de tokens sortants et 0,20 $ par million de tokens pour les lectures de cache. Anthropic explique cette réduction des coûts réels par une consommation de tokens moindre : l’entreprise estime que Sonnet 5.5 coûte jusqu’à 30 % de moins par tâche que son prédécesseur.
Claude Sonnet 5.5 renforce également ses protections
Dans le même temps, Anthropic renforce les protections de Claude Sonnet 5.5 dans le domaine de la cybersécurité. Ses capacités dans ce secteur sont proches de celles d’Opus 5 selon l’entreprise, ce qui a conduit Anthropic à appliquer pour la première fois des garde-fous et des mécanismes de sécurité à un modèle Sonnet, similaires à ceux utilisés dans ses modèles les plus puissants.
Le modèle d’IA améliore également ses performances dans le travail intellectuel et l’utilisation informatique. Anthropic lui attribue notamment un score de 80,1 % dans OSWorld 2.1, contre 57 % pour Sonnet 5, ainsi qu’un score de 64,5 % dans Humanity’s Last Exam avec outils, par rapport à 54,9 % pour son prédécesseur. Dans le cadre de GDPval-AA, qui évalue des tâches professionnelles dans 44 métiers et neuf secteurs, Sonnet 5.5 frôle le niveau d’Opus 5.5.
Claude Sonnet 5.5 est désormais disponible sur les différentes plateformes d’Anthropic, ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure. Anthropic prépare également Claude Haiku 5.5, son modèle destiné à des utilisations à fort volume et sensibles au coût, dans les semaines à venir.






