Publié le: 29/09/2026 @ 14:56:52: Par Nic007 Dans "Programmation"
ProgrammationAnthropic vient d'annoncer le Claude Sonnet 5.5 , le deuxième modèle de la famille Claude 5.5, et ses performances sont loin d'être négligeables. Comparé à son prédécesseur, le Sonnet 5, il génère une puissance de calcul 30 % plus rapidement et, grâce à une utilisation plus efficace des jetons, consomme jusqu'à 30 % d'énergie en moins par tâche , tout en conservant le même prix catalogue par million de jetons. Concrètement : il fait plus , plus vite et avec moins de ressources. Pour les utilisateurs intensifs de Claude, notamment via des API ou des outils comme Claude Code , cette mise à jour se fera sentir dès la réception de la facture en fin de mois. L'amélioration la plus notable concerne la programmation autonome , c'est-à-dire la capacité du modèle à travailler sur des bases de code réelles, à corriger des bogues et à gérer des tâches complexes de manière indépendante. Sur Terminal-Bench 4.0, un benchmark qui mesure précisément ce type de travail, Sonnet 5.5 obtient un score de 70,6 % contre 10,3 % pour Sonnet 5 : un bond spectaculaire entre deux versions consécutives du même modèle, et un score même supérieur aux 66,4 % d'Opus 5.5. Sur CursorBench , qui teste les modèles sur des scénarios réels de codage ambigu multi-fichiers, Sonnet 5.5 se situe à seulement deux points de Claude Opus 5.5 , le modèle phare d'Anthropic. Les testeurs d'Epic Games ont décrit le modèle comme capable de « gérer des dizaines de milliers de lignes de code pour l'architecture du système de jeu, en maintenant des réponses rapides et en menant à bien des tâches de plusieurs heures ». La société de développement d'applications Base44 a constaté que Sonnet 5.5 effectue les compilations en 3,6 itérations en moyenne , contre 7,7 pour Opus 5, avec le moins d'appels d'outils ayant échoué parmi tous les modèles testés.

Au-delà du codage, Sonnet 5.5 améliore globalement le travail intellectuel : documents, présentations, feuilles de calcul, analyses financières. Sur GDPval-AA, un benchmark qui mesure les performances sur des tâches réelles dans 44 professions différentes, Sonnet 5.5 se rapproche d'Opus 5.5 et bat Sonnet 5 d'environ 400 points. Zendesk a indiqué que le modèle Sonnet 5.5 résout les tickets d'assistance 20 % plus rapidement que les modèles Claude utilisés en production. Balyasny Asset Management, société du secteur financier, a constaté que Sonnet 5.5 utilise environ 121 000 jetons par réponse, contre 497 000 pour Sonnet 5, avec une qualité supérieure pour la quasi-totalité des tâches de recherche et d'analyse. Anthropic rapporte également un test interne : ils ont fourni au modèle les documents d'une conférence téléphonique trimestrielle sur les résultats d'une société cotée en bourse, un modèle de diapositives, et lui ont demandé de produire une présentation opérationnelle de 10 diapositives. Deux experts ont jugé la première version prête à être diffusée sans aucune modification.

Le Sonnet 5.5 est le premier modèle Sonnet à bénéficier des protections de cybersécurité avancées habituellement réservées aux modèles plus performants. La raison est simple : ses capacités offensives en matière de cybersécurité sont comparables à celles de l’Opus 5, et Anthropic a donc décidé d’appliquer les mêmes mesures de sécurité. Les tâches de développement logiciel ordinaires ne sont pas affectées, mais les requêtes à haut risque sont automatiquement redirigées vers Sonnet 5. Autre nouveauté notable : Sonnet 5.5 est la première version de Sonnet dotée de classificateurs anti-distillation . La distillation est une technique utilisée par des acteurs malveillants pour exploiter les capacités d'un modèle à grande échelle grâce à des milliers de faux comptes, contournant ainsi les protections. Anthropic a également introduit la « préservation de la pensée » : le raisonnement du modèle est désormais indissociable du compte qui l'a généré.

Le prix catalogue reste inchangé par rapport à Sonnet 5 : 2 $ par million de jetons d’entrée et 10 $ par million de jetons de sortie. Les économies réelles proviennent de l’efficacité : un nombre réduit de jetons est nécessaire pour effectuer le même travail, ce qui diminue le coût effectif par tâche jusqu’à 30 %. Sonnet 5.5 est déjà disponible sur toutes les plateformes , y compris Amazon Web Services, Google Cloud et Microsoft Azure. Les utilisateurs de Claude Code ou d'applications Anthropic le trouveront comme modèle par défaut pour un effort moyen. Dans les semaines à venir, le Claude Haiku 5.5 arrivera également , conçu pour les applications à grand volume et sensibles aux coûts : la famille Claude 5.5 sera complétée par le modèle le plus économique de la gamme, qui rejoindra le Sonnet et l'Opus 5.5 .

Il se dessine un modèle qui redéfinit le rapport qualité-prix sur le marché de l'IA de milieu de gamme : Sonnet 5.5 n'est pas Opus, et Anthropic le précise, mais pour la grande majorité des tâches quotidiennes, la différence est difficilement perceptible, tandis que l'impact sur le budget est immédiat. L'enjeu pour les utilisateurs sera de comprendre où se situe la limite entre les deux modèles, même si Anthropic ne propose pas de distinction claire .
Poster un commentaire
Vous devez être identifié pour accéder à cette fonctionnalité

Utilisateur
Mot de passe
 
Informaticien.be - © 2002-2026 Akretio SRL  - Generated via Kelare Haut de page