Claude Sonnet 5 est disponible : puissance proche d'Opus, coût en tokens élevé
- Ce qui s’est passé
- Anthropic launched Claude Sonnet 5 on June 30 — near-Opus 4.8 agentic performance at Sonnet pricing, now the default model for all plans.
- Pourquoi c’est important
- A new tokenizer produces ~30% more tokens for English input, making the headline price misleading — effective costs are up even though per-token rates are flat. temperature, top_p, and top_k are gone.
- Que faire
- Upgrade from Sonnet 4.6: yes, the capability jump is worth it. Budget for agent workloads: factor in ~30% more tokens. Migrate any code relying on temperature/top_p/top_k sampler parameters.
Anthropic a livré Claude Sonnet 5 le 30 juin, en faisant le modèle par défaut sur tous les plans Free et Pro. Notre verdict : recommandé. Le saut de capacité agentique par rapport à Claude 4 Sonnet est sans ambiguïté — il termine des tâches complexes en plusieurs étapes sur lesquelles son prédécesseur calait, vérifie sa propre production sans qu'on le lui demande et réduit l'écart avec Opus 4.8 à une marge infime. Mais prévoyez une augmentation d'environ 30 % du nombre de tokens due au nouveau tokenizer, et migrez tout code qui utilise temperature, top_p ou top_k — ces paramètres ont disparu.
Ce qui s'est passé
Claude Sonnet 5 réduit l'écart de performance avec Opus 4.8 à la marge la plus étroite jamais observée. Aux niveaux d'effort moyens, il délivre la même qualité de sortie pour moins cher. Aux réglages d'effort plus élevés — ceux que les agents utilisent pour du travail soutenu en plusieurs étapes — il peut égaler Opus 4.8 en recherche agentique (BrowseComp : 84,7 %) et en utilisation d'ordinateur (OSWorld-Verified : 81,2 %).
Le chiffre phare est un bond de 13,4 points sur Terminal-Bench 2.1 par rapport à Claude 4 Sonnet. Les partenaires en accès anticipé confirment les benchmarks : Stripe l'a qualifié de « couche d'exécution solide pour le travail d'ingénierie logicielle en plusieurs étapes ». Le cofondateur de Lovable rapporte « la même qualité de sortie, moins d'étapes pour y arriver ».
Le hic, honnêtement divulgué par Anthropic en note de bas de page : un nouveau tokenizer transforme la même entrée en environ 1,0 à 1,35 fois plus de tokens. Le tarif par token semble inchangé — 2 $/10 $ en tarif de lancement (jusqu'au 31 août), puis 3 $/15 $ en tarif standard — mais quand un appel qui utilisait 5 000 tokens en nécessite désormais 7 000, votre facture grimpe de 40 % même si la grille tarifaire est restée la même.
Rupture nette : Sonnet 5 ne prend plus en charge temperature, top_p ou top_k dans l'API ni dans Workbench. Anthropic s'oriente vers un contrôle basé sur l'effort (low/medium/high/extra-high) au lieu des paramètres d'échantillonnage traditionnels.
Pourquoi c'est important
C'est le modèle sur lequel Anthropic veut que les entreprises fassent tourner leurs agents. C'est le cheval de trait de la gamme Sonnet — suffisamment proche d'Opus 4.8 pour que de nombreuses charges de travail n'aient pas besoin du niveau supérieur, tout en restant assez abordable pour éviter que les budgets agents ne s'envolent.
La subtilité du tokenizer n'est pas rédhibitoire, mais c'est un piège budgétaire pour les équipes qui font passer leurs agents à l'échelle de manière agressive. Les tarifs par token ne sont plus la bonne métrique — comptez les tokens par tâche avant et après la migration.
Ce qui change pour vous
Si vous êtes sur Claude 4 Sonnet, passez à la version supérieure — le saut de capacité est réel et le tarif de lancement le rend neutre en coût jusqu'en août. Si vous faites tourner des charges de travail agentiques à grande échelle, recalculez vos budgets tokens avant de basculer. Si vos appels API passent temperature, top_p ou top_k, supprimez-les — ces paramètres sont morts sur Sonnet 5.
FAQ
Q : Pourquoi le changement de tokenizer est-il important si le tarif par token reste le même ? Un nouveau tokenizer découpe le texte en plus de morceaux — environ 30 % de plus pour du texte en anglais. Votre coût par appel est égal au nombre de tokens × le tarif par token, donc si le nombre de tokens augmente de 30 %, votre facture augmente de 30 % même si la grille tarifaire semble inchangée.
Q : Par quoi sont remplacés temperature, top_p et top_k ? Le contrôle basé sur l'effort d'Anthropic : réglez le thinking avec des niveaux d'effort (low/medium/high/extra-high) au lieu des paramètres d'échantillonnage traditionnels.
Q : Verrouiller le tarif de lancement ou attendre les tarifs standards de septembre ? Verrouillez maintenant. Le tarif de lancement à 2 $/10 $ par million de tokens permet d'économiser environ 33 % par rapport aux tarifs standards de 3 $/15 $.
Que faire
- 1 Audit agent token budgets: the new tokenizer adds ~30% tokens for English input — your per-call costs will rise even if per-token rates look flat
- 2 Remove temperature/top_p/top_k from API calls — these parameters are no longer supported on Sonnet 5
- 3 Lock in introductory pricing: $2/$10 through Aug 31, then $3/$15 standard — plan migration timelines accordingly
Outils et modèles concernés
Ne ratez plus jamais une mise à jour
Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.