Histoire
septembre 28, 2026
Anthropic affirme que Sonnet 5.5 est plus rapide et moins cher — mais les modèles plus intelligents continuent de planer
L’argument d’Anthropic en faveur de Sonnet 5.5 est que le travail quotidien avec l’IA ne requiert pas toujours le modèle le plus puissant de l’entreprise : la vitesse, le coût et les contrôles de sécurité peuvent compter davantage. Mais les premières discussions montrent que l’attrait habituel des systèmes haut de gamme reste difficile à dissiper, même lorsque les différences dans les flux de travail réels sont minimes.
Trois mois après avoir présenté Sonnet 5 comme un modèle efficace pour le déploiement d’agents d’IA, Anthropic revient avec un argumentaire plus affûté pour son offre Claude de milieu de gamme : rendre le modèle de référence au quotidien plus rapide, moins cher et suffisamment capable pour concurrencer le niveau premium sur les tâches les plus importantes.1
Lors du lancement, l’entreprise a déclaré que Sonnet 5.5 est 30 % plus rapide que son prédécesseur et coûte jusqu’à 30 % moins cher pour la plupart des tâches. Sa cible est volontairement banale mais commercialement importante : corriger des bugs, produire des documents et créer des diapositives, plutôt que de poursuivre les tâches de pointe les plus exigeantes.
2 Anthropic affirme également que le modèle peut surpasser Opus 5.5 sur les benchmarks de codage agentique, où sa capacité à exécuter plusieurs agents sans dépasser les limites de coût peut constituer un avantage.1
Le compromis ne se résume pas simplement au prix face à la puissance. Sonnet 5.5 dispose de capacités de cybersécurité qu’Anthropic décrit comme comparables à celles d’Opus 5, ce qui en fait le premier modèle Sonnet soumis aux mêmes garde-fous cybernétiques plus stricts que ceux utilisés pour les systèmes haut de gamme de l’entreprise.1 Un autre article a présenté ces protections comme des mesures « conçues pour empêcher qu’il soit utilisé à mauvais escient ».3
Les premiers messages sur les performances ont été tout aussi directs. Addy Osmani a mis en avant les améliorations du codage agentique et de l’utilisation d’ordinateurs, citant des scores de 70,6 % sur Terminal-Bench 4.0 et de 80,1 % sur OSWorld 2.1.
4 L’argument de l’entreprise est clair : pour un travail bien délimité, le modèle agile pourrait offrir un meilleur rapport qualité-prix.
Pourtant, le lancement met aussi en lumière l’obstacle psychologique auquel est confronté chaque modèle de milieu de gamme. Aravind Srinivas a déclaré avoir constaté des « différences minimes » après avoir transféré des dizaines de flux de travail vers Opus 5.5, tout en ressentant « le FOMO de ne pas utiliser le modèle le plus intelligent ».
5 Le test de Sonnet 5.5 consiste désormais à déterminer si des factures moins élevées et des résultats plus rapides peuvent transformer cette anxiété en une raison de ne pas passer à la version supérieure.