Anthropic a dévoilé le 30 juin 2026 Claude Sonnet 5, la nouvelle version de son modèle « milieu de gamme », présentée comme un moyen nettement moins cher de faire tourner des agents. Le laboratoire promet des performances proches de son modèle haut de gamme Opus 4.8, mais à une fraction du prix — de quoi se positionner face à Opus, au GPT-5.5 d'OpenAI et au Gemini 3.1 Pro de Google. Le modèle devient par la même occasion l'option par défaut pour les abonnés gratuits et Pro.
Des agents plus autonomes, pour moins cher
Sonnet 5 est taillé pour l'usage agentique : selon TechCrunch, il peut « établir des plans, utiliser des outils comme des navigateurs et des terminaux, et fonctionner de façon autonome » à un niveau qui exigeait encore récemment des modèles plus gros et plus coûteux. Dans l'annonce officielle, Anthropic revendique une nette progression sur son prédécesseur Sonnet 4.6 en raisonnement, utilisation d'outils, code et travail intellectuel, avec de meilleures courbes coût/performance sur les évaluations d'agent (BrowseComp) et d'usage d'ordinateur (OSWorld-Verified).
Les gains restent toutefois mesurés. Sur un benchmark de code agentique, Sonnet 5 obtient 63,2 %, contre 69,2 % pour Opus 4.8 et 58,1 % pour Sonnet 4.6 : Anthropic reconnaît qu'Opus 4.8 demeure le modèle « de choix » quand la précision prime. Côté technique, Sonnet 5 conserve une fenêtre de contexte d'un million de tokens et une sortie maximale de 128 000 tokens, avec le « raisonnement adaptatif » activé par défaut, note Simon Willison.
Un prix « d'appel » et un tokenizer qui change la donne
À son lancement, Sonnet 5 est facturé 2 dollars par million de tokens en entrée et 10 dollars en sortie, jusqu'au 31 août 2026 ; au-delà, les tarifs passeront à 3 et 15 dollars. Ce positionnement le rend moins cher qu'Opus 4.8, que GPT-5.5 et que Gemini 3.1 Pro — mais plus cher que le Gemini 3.5 Flash de Google.
Un point mérite l'attention : Sonnet 5 embarque un nouveau tokenizer qui découpe le même texte en davantage d'unités facturables — jusqu'à environ 1,35 fois plus selon le type de contenu (près de 1,4× en anglais, ~1,27× pour du code Python, quasi inchangé en mandarin). Anthropic assure avoir calibré son prix d'introduction pour que la bascule reste « à peu près neutre » côté facture, mais la hausse programmée en septembre, combinée à cet effet, mérite d'être surveillée.
Sur la sûreté, le laboratoire — fidèle à sa communication prudente déjà éprouvée sur sa classe Mythos grand public et sur le feu vert de déploiement de Mythos 5 / Fable 5 — annonce un « taux plus faible de comportements indésirables » que Sonnet 4.6, une meilleure résistance aux injections de prompt, mais des performances volontairement dégradées sur le développement d'exploits en cybersécurité. Le modèle arrive dans une séquence chargée pour Anthropic, entre préparatifs d'entrée en Bourse, frictions avec de gros clients comme Microsoft et lancement, le même jour, de Claude Science, son atelier d'IA pour la recherche.