Anthropic dévoile Claude Sonnet 5.5, une nouvelle version de son modèle d’intelligence artificielle intermédiaire qui promet de meilleures performances, notamment en programmation, tout en conservant les mêmes tarifs. Plus rapide et moins gourmand en ressources que Sonnet 5, il parvient même à dépasser Opus 5.5 sur certains tests spécialisés.
Selon l’entreprise californienne, Claude Sonnet 5.5 serait au moins 30 % plus rapide que son prédécesseur et pourrait réduire jusqu’à 30 % le coût de certaines tâches. Ces progrès s’accompagnent également de protections renforcées, jusqu’ici principalement réservées aux modèles les plus puissants de la gamme.
Claude Sonnet 5.5 progresse fortement en programmation
C’est dans le développement informatique que Claude Sonnet 5.5 affiche certaines de ses améliorations les plus importantes. Le modèle est notamment conçu pour écrire, analyser et corriger du code, mais aussi pour mener des tâches complexes nécessitant plusieurs étapes.
Sur Terminal-Bench 4.0, un test évaluant la capacité d’une intelligence artificielle à effectuer de manière autonome des opérations complexes dans un terminal informatique, Sonnet 5.5 atteint un taux de réussite de 70,6 %.
À titre de comparaison, Sonnet 5 obtenait seulement 10,3 % sur ce même test. Le nouveau modèle dépasse également Opus 5.5, la solution haut de gamme d’Anthropic, qui affiche un résultat de 66,4 %.
Des performances proches du modèle haut de gamme
Sonnet 5.5 améliore également ses résultats sur FrontierCode, un test destiné à mesurer la capacité d’un modèle à produire des modifications de code pouvant être intégrées directement dans un projet sans intervention humaine supplémentaire.
À niveau de réflexion identique, le nouveau modèle gagne dix points par rapport à Sonnet 5. Anthropic indique parallèlement que le coût par tâche peut être environ quinze fois inférieur dans ce scénario.
Ces résultats montrent que l’écart entre les modèles intermédiaires et les solutions les plus puissantes d’Anthropic se réduit sur certaines tâches de programmation.
Epic Games a également expérimenté Claude Sonnet 5.5 sur des charges de travail plus longues. Le modèle aurait ainsi traité des dizaines de milliers de lignes de code liées à l’architecture d’un jeu vidéo et poursuivi des tâches complexes pendant plusieurs heures.
Des tarifs inchangés malgré les gains de performance
Anthropic conserve la grille tarifaire appliquée précédemment. Sur sa plateforme destinée aux développeurs, Claude Sonnet 5.5 coûte toujours 2 dollars par million de tokens transmis au modèle et 10 dollars par million de tokens générés en réponse.
Les tokens sont de petites unités de texte utilisées par les systèmes d’intelligence artificielle pour traiter les requêtes et produire leurs réponses. Ils servent également de base à la facturation de nombreux services d’IA destinés aux professionnels et aux développeurs.
Jusqu’à 30 % d’économies par tâche selon Anthropic
Même si le prix unitaire reste identique, Anthropic affirme que Sonnet 5.5 utilise généralement moins de tokens pour accomplir un même travail. Cette efficacité accrue pourrait réduire jusqu’à 30 % le coût total de certaines tâches.
Le modèle serait également capable de mieux organiser son travail en regroupant davantage d’actions au lieu de les exécuter séparément. Cette approche lui permettrait d’achever certaines opérations en moins d’étapes.
Slack a notamment testé Claude Sonnet 5.5 sans modifier les instructions utilisées avec Sonnet 5. Le nouveau modèle a obtenu de meilleurs résultats sur la quasi-totalité des évaluations réalisées pour l’assistant interne de l’entreprise, tout en générant environ 14 % de tokens en moins.
Anthropic renforce les protections de Claude Sonnet 5.5
L’amélioration des capacités du modèle conduit également Anthropic à renforcer ses mécanismes de sécurité. Claude Sonnet 5.5 bénéficie ainsi de protections jusqu’ici davantage associées aux modèles les plus puissants de l’entreprise.
Cette évolution accompagne la montée en puissance des modèles intermédiaires, désormais capables d’effectuer certaines tâches complexes autrefois principalement réservées aux solutions haut de gamme.
Avec Claude Sonnet 5.5, Anthropic mise ainsi sur une combinaison de performances accrues en programmation, de rapidité d’exécution et de maîtrise des coûts. Les résultats communiqués par l’entreprise montrent surtout que l’écart entre les différentes catégories de modèles d’intelligence artificielle continue de se réduire, notamment pour les usages professionnels liés au développement logiciel.

Gaspard Delacroix est rédacteur pour Dakarinfo.net, où il couvre l’actualité nationale et internationale ainsi que des sujets liés à la politique, à l’économie, à la technologie, au sport, au divertissement et au mode de vie. Il privilégie une information claire, rigoureuse et accessible, en mettant l’accent sur les faits essentiels et les enjeux qui concernent les lecteurs. Son travail vise à fournir des informations utiles, à suivre les évolutions de l’actualité et à mettre en lumière les sujets qui façonnent le quotidien.

D'autres articles
Meta envisage des lunettes capables d’identifier les visages, un projet qui suscite des inquiétudes
Le patron de Nvidia estime que l’IA a désormais atteint le niveau de l’intelligence humaine
À Strasbourg, trois chercheurs utilisent l’intelligence artificielle pour traquer les déchets plastiques dans les rivières