Le 30 juin 2026, Anthropic a publié Claude Sonnet 5, la nouvelle version de son modèle « milieu de gamme ». Sur le papier, c’est une itération. Dans les faits, c’est un repositionnement : Anthropic annonce des performances proches d’Opus 4.8 sur les tâches agentiques, pour un tarif divisé par plus de deux. Sonnet 5 devient le modèle par défaut sur les plans Free et Pro, dans Claude Code et sur l’API (identifiant claude-sonnet-5).
Ce qui change vraiment
Anthropic présente Sonnet 5 comme « le Sonnet le plus agentique » à ce jour : il planifie, enchaîne des appels d’outils (terminal, navigateur), et tient des tâches longues en autonomie qui, il y a quelques mois encore, exigeaient un modèle plus lourd. Les gains annoncés portent sur le raisonnement, l’usage d’outils, le code et le travail analytique. Deux points nous intéressent particulièrement au quotidien :
- Auto-vérification — le modèle relit et contrôle sa propre sortie sans qu’on le lui demande, ce qui réduit les allers-retours sur les tâches multi-étapes.
- Moins d’hallucination et de flagornerie — Anthropic revendique des taux en baisse, un point clé quand on délègue de la revue de code ou de l’analyse.
Les chiffres
Côté benchmarks, Anthropic met en avant SWE-bench (code complexe), BrowseComp (recherche agentique) et OSWorld-Verified (usage ordinateur), avec un score de 46,8 % à Humanity’s Last Exam outillé. Mais le vrai argument est le rapport coût/performance :
- Prix d’introduction (jusqu’au 31 août 2026) : 2 $ / million de tokens en entrée, 10 $ en sortie.
- Prix standard ensuite : 3 $ / 15 $ le million.
- Repère Opus 4.8 : 5 $ / 25 $ — soit environ 40 % plus cher pour des perfs désormais très proches sur les tâches agentiques.
Votre équipe utilise Claude Code ?
Découvrir le workshop →Notre analyse : la bascule économique des agents
L’intérêt réel de Sonnet 5 n’est pas un benchmark de plus, c’est l’économie des agents. Un agent de code qui tourne en boucle (lecture, édition, tests, correction) consomme énormément de tokens de sortie. Diviser ce coût par ~2,5 tout en gardant un niveau quasi-Opus, ça change ce qu’on peut se permettre : lancer plusieurs sous-agents en parallèle, itérer plus longtemps sur une tâche, ou tout simplement rendre rentable l’automatisation de tickets à faible valeur.
Concrètement, pour une équipe Symfony : Sonnet 5 comme modèle par défaut dans Claude Code devient le bon compromis pour l’écrasante majorité des tâches (refactoring, tests, migration Rector, revue de PR), en réservant Opus aux passages vraiment durs (architecture, debug retors). C’est exactement l’arbitrage que nous faisons déjà en interne, et la baisse de prix le rend encore plus net.
Un point de vigilance signalé par Anthropic : le tokenizer a été mis à jour et peut produire 1,0 à 1,35× plus de tokens selon le contenu. À surveiller si vous pilotez des budgets au token près sur de gros volumes.
Sources : Introducing Claude Sonnet 5 (Anthropic), TechCrunch, Simon Willison.
Votre équipe utilise Claude Code ?
Workshop intensif : votre équipe opérationnelle en 1 jour.