Publié le: 23/09/2026 @ 14:34:54: Par Nic007 Dans "Programmation"
ProgrammationAnthropic a annoncé le Claude Opus 5.5 , premier modèle de sa nouvelle gamme 5.5. Il ne s'agit pas d'une simple mise à jour : comparé à l'Opus 5, ce nouveau modèle coûte 40 % moins cher pour les charges de travail classiques, offre une productivité 30 % supérieure et surpasse son prédécesseur sur presque tous les points, d'après des tests internes. Parallèlement, Anthropic continue d'améliorer la sécurité, ce modèle ayant obtenu les meilleurs scores jamais enregistrés lors des tests d'alignement de l'entreprise. Les chiffres cités par Anthropic sont concrets et vérifiables. Un testeur a réalisé la migration de 680 000 lignes de code en moins d'une journée , une tâche qui aurait nécessité des semaines pour une équipe d'ingénieurs. Un autre a utilisé Opus 5.5 pour auditer et corriger un code source de 200 000 lignes en moins de trois heures : Opus 5 avait nécessité plus de 20 heures et consommé 250 % de jetons supplémentaires. Anthropic a également testé en interne la traduction de HAProxy , un logiciel populaire d'équilibrage du trafic web, du langage C vers Rust. Opus 5.5 et son prédécesseur, Fable 5.1, ont tous deux réussi la quasi-totalité des tests de régression. Opus 5.5 s'est exécuté en 9,5 heures contre 12 heures pour Fable 5.1, pour un coût réduit de 51 % . Sur les benchmarks de programmation d'agents, Opus 5.5 surpasse GPT-6 Astra d'OpenAI avec un coût par tâche environ cinq fois inférieur .

Il ne s'agit pas seulement du code : sur GDPval-AA v2.1 , un test qui simule le travail professionnel réel dans 44 secteurs différents, Opus 5.5 obtient un score de 1 846 points Elo, contre 1 735 pour Fable 5.1 et 1 708 pour Opus 5. Du côté de la recherche et de l'analyse financière , Walleye Capital a rapporté que le modèle avait même détecté une erreur dans les instructions de son test d'évaluation, ce qu'aucun autre modèle n'avait jamais fait auparavant. Les prix sont en baisse générale par rapport à Opus 5. Les jetons d'entrée coûtent 4 $ par million (contre 5 $ auparavant), et les jetons de sortie 20 $ par million (contre 25 $ auparavant). Le poste le plus intéressant concerne les lectures de cache , qui représentent la majeure partie des coûts liés aux tâches de codage et aux agents d'IA : leur coût chute à 0,20 $ par million, contre 0,50 $ auparavant, soit une baisse de 60 %. Anthropic augmente également la limite d'utilisation à cinq heures pour les forfaits Pro, Max, Team et Enterprise. Les abonnés bénéficient également d'une réinitialisation de la limite de débit, leur permettant d'utiliser le service à leur guise. Un mode Rapide est également disponible dans Claude Code et sur la plateforme API, offrant des vitesses jusqu'à 2,5 fois supérieures pour un coût de 8 $ par million de jetons entrants et de 40 $ par million de jetons sortants.

Opus 5.5 est le premier modèle Opus à intégrer les mêmes protections en matière de cybersécurité, de biologie et de lutte contre le détournement de ses capacités que Fable 5.1 (c'est-à-dire la tentative d'exploiter les capacités du modèle à l'échelle industrielle pour créer des modèles dérivés dépourvus des protections d'origine). En pratique, certaines catégories de tâches sont automatiquement redirigées vers des modèles plus anciens : les requêtes de cybersécurité offensive sont dirigées vers Opus 4.8, tandis que les requêtes de biologie avancée restent bloquées jusqu'à vérification. En matière d'alignement, Opus 5.5 tente de contourner les limites imposées environ 85 % moins souvent qu'Opus 5 ou Claude Mythos 5.1, et chaque tentative enregistrée était de faible gravité et auto-déclarée par le modèle lui-même. Anthropic reconnaît toutefois un problème non résolu : le modèle semble souvent se croire encore en phase d’évaluation , ce qui rend difficile la compréhension de ses performances réelles. Ce problème n’est pas résolu, et l’entreprise le précise.

La fonctionnalité de préservation du raisonnement , une protection contre la distillation introduite avec Fable 5.1, est également disponible : elle empêche les utilisateurs de l’API de modifier le contexte précédent du modèle pour en extraire le raisonnement. Elle s’applique aux comptes API créés à partir du 31 août 2026. Opus 5.5 est également le premier modèle Opus qui ne peut pas être utilisé avec le mode de raisonnement désactivé. L'un des problèmes les plus fréquemment relevés par les testeurs concerne le style d'écriture d'Opus 5.5 . Anthropic avait reçu de nombreux retours négatifs sur Opus 5, jugé trop verbeux et difficile à suivre. Le nouveau modèle place les informations les plus importantes en haut , utilise moins de jargon, respecte les règles de style définies et produit un texte plus concis sans perte de précision. Un ingénieur de Ramp a écrit qu'il « écrit comme un bon collègue », et un autre chez Stripe a décrit une session de rebasage sur 40 demandes d'extraction au cours de laquelle le modèle a exécuté une douzaine de sous-sessions tout en gardant tout clair même après des heures d'absence. Anthropic souligne que cette clarté n'est pas qu'une simple commodité : des résultats plus faciles à lire et à vérifier constituent également un avantage en matière de sécurité, facilitant la détection des erreurs ou des comportements inattendus.

Claude Opus 5.5 est disponible dès aujourd'hui sur toutes les plateformes , notamment Amazon Web Services, Google Cloud et Microsoft Azure. Le modèle est accessible via l'API. Claude Sonnet 5.5 et Claude Haiku 5.5claude-opus-5-5 seront également disponibles dans les prochaines semaines , avec des améliorations similaires en termes de performances, d'efficacité et de sécurité. Le véritable test d’Opus 5.5 sera de savoir si l’ avantage concurrentiel en termes de coûts se maintient dans le temps ou si les nouveaux modèles d’OpenAI sont déjà supérieurs.
Poster un commentaire
Vous devez être identifié pour accéder à cette fonctionnalité

Utilisateur
Mot de passe
 
Informaticien.be - © 2002-2026 Akretio SRL  - Generated via Kelare Haut de page