Aller au contenu
Promptique

Rechercher dans Promptique

Actualités

Claude Sonnet 5 conserve le tarif 2 $/10 $ : prix réel et migration

Claude Sonnet 5 garde son tarif de 2 $/10 $ par million de tokens. Analyse du prix réel, du nouveau tokenizer, de la migration API et des limites.

Anthropic a rendu permanent le tarif de lancement de Claude Sonnet 5, soit 2 $ par million de tokens d’entrée et 10 $ par million de tokens de sortie. La hausse à 3 $/15 $, initialement prévue le 1er septembre 2026, est annulée depuis le 10 août. Cette baisse face à Sonnet 4.6 mérite toutefois un calcul par tâche : le nouveau tokenizer peut compter davantage de tokens pour un même texte.

Note du 12 août 2026. Cet article tient compte de la correction tarifaire publiée par Anthropic le 10 août. Les performances et évaluations de sécurité citées sont attribuées au fournisseur et à sa system card.

En bref

  • Claude Sonnet 5 a été lancé le 30 juin 2026 sous l’identifiant API claude-sonnet-5.
  • Son tarif de 2 $/10 $ par million de tokens devient permanent. La hausse annoncée pour septembre est annulée.
  • Le modèle accepte un contexte maximal d’un million de tokens et jusqu’à 128 000 tokens de sortie.
  • Le nouveau tokenizer peut transformer un même texte en environ 1 à 1,35 fois plus de tokens que Sonnet 4.6.
  • Adaptive thinking est activé par défaut. budget_tokens et les valeurs non standard de temperature, top_p ou top_k provoquent une erreur 400.
  • Anthropic annonce des progrès face à Sonnet 4.6 et une proximité avec Opus 4.8 sur certaines tâches, pas une supériorité universelle.

Sommaire

Un tarif permanent, mais un coût à recalculer

Au lancement du 30 juin, Anthropic présentait 2 $/10 $ comme un prix promotionnel valable jusqu’au 31 août, avant un retour à 3 $/15 $. Le billet officiel Claude Sonnet 5 comporte désormais une modification datée du 10 août : le prix initial devient le prix standard et l’augmentation n’aura pas lieu. Une page qui reprend encore l’ancien calendrier doit donc être corrigée.

Tarifs Claude Platform vérifiés le 12 août 2026, par million de tokens
UsageEntréeSortie
Requête standard Sonnet 52 $10 $
Batch Sonnet 51 $5 $
Sonnet 4.6 standard3 $15 $

Le prix par token baisse d’un tiers face à Sonnet 4.6. Le coût d’un travail identique ne baisse pas forcément d’un tiers, car Sonnet 5 utilise un tokenizer différent. Anthropic indique qu’un même contenu peut représenter environ 1 à 1,35 fois plus de tokens, selon sa nature. Cette variation réduit aussi la quantité de texte qui tient réellement dans une fenêtre annoncée à un million de tokens.

Exemple de calcul du prix réel

Prenons une tâche qui consommait 100 000 tokens d’entrée et 20 000 tokens de sortie avec Sonnet 4.6. Elle coûtait 0,30 $ en entrée et 0,30 $ en sortie, soit 0,60 $. Si le même texte est compté 1,3 fois plus lourd par Sonnet 5, il représente 130 000 tokens d’entrée et 26 000 de sortie. La facture illustrative devient 0,26 $ plus 0,26 $, soit 0,52 $. La baisse réelle est alors proche de 13 %, et non de 33 %.

Ce calcul n’est pas une prévision : le ratio dépend du contenu, et la longueur de la réponse peut changer avec le modèle et le niveau d’effort. Pour décider, mesurez les tokens, la réussite et les relances sur vos propres cas. Le cache de prompt peut réduire le coût des préfixes répétés, tandis que le Batch API divise par deux les tarifs lorsque le traitement asynchrone convient.

Disponibilité, contexte et usages agentiques

Claude Sonnet 5 est disponible dans les offres Claude, Claude Code et la Claude Platform. Il est devenu le modèle par défaut des offres Free et Pro au lancement, et reste accessible aux utilisateurs Max, Team et Enterprise. Côté développeur, son identifiant est claude-sonnet-5. Anthropic documente aussi sa disponibilité sur AWS, Google Cloud et Microsoft Foundry, avec des modalités de facturation ou de résidence qui peuvent différer.

La fenêtre de contexte est d’un million de tokens par défaut et constitue aussi le maximum. La sortie peut atteindre 128 000 tokens. Ces plafonds ne garantissent ni une attention uniforme à chaque détail, ni une réponse aussi longue sans troncature. Le budget max_tokens couvre le raisonnement adaptatif et le texte final : une tâche difficile peut consommer une grande partie de cette enveloppe avant la réponse visible.

Anthropic décrit Sonnet 5 comme son modèle Sonnet le plus agentique : il peut planifier, utiliser un navigateur ou un terminal et poursuivre un travail en plusieurs étapes. Ce sont des capacités de modèle, pas une autorisation implicite. Dans un agent, les outils, permissions, budgets et confirmations doivent être bornés séparément. Le guide Promptique des agents IA et de MCP détaille ces contrôles.

Adaptive thinking, effort et changements d’API

Sur Sonnet 5, adaptive thinking est activé par défaut. Le modèle choisit quand et combien raisonner dans la limite disponible. Le paramètre effort permet de régler le compromis entre qualité, consommation et latence. Anthropic propose les niveaux low, medium, high, xhigh et max. high est la valeur par défaut ; xhigh est recommandé par le fournisseur pour les tâches agentiques et de code les plus difficiles.

Augmenter l’effort n’améliore pas automatiquement une extraction simple. Cela peut surtout allonger le raisonnement, la latence et la facture. À l’inverse, un effort trop faible peut raccourcir une investigation complexe. La bonne unité de comparaison est donc le coût par résultat accepté, avec les mêmes entrées et critères, plutôt que le nombre brut de tokens.

Changements à traiter lors du passage de Sonnet 4.6 à Sonnet 5
ÉlémentComportement Sonnet 5Action
Identifiantclaude-sonnet-5Modifier le modèle et tracer sa version
Thinking absentAdaptive thinking activéMesurer latence et consommation
budget_tokensErreur HTTP 400Utiliser adaptive thinking et effort
temperature, top_p, top_k non standardErreur HTTP 400Retirer ces valeurs et guider le style dans le prompt
Comptage des tokensEnviron 1 à 1,35 fois le comptage antérieurRecompter prompts et sorties
max_tokensPartagé entre thinking et réponseLaisser une marge et surveiller les troncatures

Anthropic appelle Sonnet 5 une mise à niveau directe, mais ces différences excluent une substitution aveugle. Un code qui envoie encore un budget de réflexion manuel ou une température personnalisée échouera immédiatement. Même sans erreur, l’activation du raisonnement par défaut peut modifier temps de réponse et dépenses.

Performances annoncées : Sonnet 4.6, Sonnet 5 et Opus 4.8

Anthropic annonce une amélioration face à Sonnet 4.6 en raisonnement, utilisation d’outils, codage et travail de connaissance. Le fournisseur estime aussi que Sonnet 5 se rapproche d’Opus 4.8 à moindre prix et peut atteindre son niveau sur certaines tâches avec un effort élevé. La formulation importante est « certaines tâches ». Elle ne démontre pas une équivalence générale entre les deux modèles.

Les graphiques de lancement s’appuient notamment sur BrowseComp pour la recherche agentique et OSWorld-Verified pour l’utilisation d’un ordinateur. Ils décrivent un protocole, un budget et des outils déterminés. Le résultat peut changer sur une autre langue, un dépôt privé, des documents métier, un outil moins fiable ou une contrainte de temps différente. Le comparatif Promptique de ChatGPT, Claude, Gemini et Mistral rappelle pourquoi le meilleur modèle dépend du produit complet et de l’usage.

La correction méthodologique de BrowseComp

Anthropic a corrigé le graphique BrowseComp dès le 30 juin. La première version utilisait une méthode plus simple qui sous-estimait la performance de Sonnet 5. Le graphique révisé reprend la méthode de la system card, avec un budget de dix millions de tokens, compaction et appels d’outils programmatiques. Cette transparence est utile, mais le budget très élevé renforce la nécessité de tester un scénario réaliste avant de généraliser le score.

Sécurité et points de vigilance

Selon les évaluations préalables d’Anthropic, Sonnet 5 refuse mieux certaines demandes malveillantes et résiste davantage aux tentatives de détournement par injection de prompt que Sonnet 4.6. Le fournisseur mesure aussi moins d’hallucination et de complaisance. Sa propre analyse comportementale relève toutefois davantage de comportements mal alignés que chez Opus 4.8 et Mythos Preview. Il faut donc conserver les nuances, pas résumer la system card par « plus sûr ».

Sonnet 5 est le premier modèle de la gamme Sonnet lancé avec des garde-fous cyber en temps réel. Une requête interdite ou jugée à haut risque peut être refusée tout en retournant un statut HTTP 200. L’application doit examiner stop_reason: "refusal" au lieu de considérer tout code 200 comme un résultat exploitable. Anthropic indique par ailleurs que Sonnet 5 reste moins capable en cybersécurité offensive que ses modèles Opus spécialisés.

Aucun de ces tests ne supprime les risques ordinaires : source inventée, interprétation erronée, action trop large ou instruction malveillante présente dans un document. Pour un contenu factuel, appliquez la méthode de la leçon Hallucinations : vérifier avant de faire confiance. Pour un agent, faites appliquer les limites par le code et les permissions, pas seulement par une phrase dans le prompt.

Méthode de test et checklist de migration

Une migration utile commence par un jeu de cas représentatifs et une version de référence Sonnet 4.6. Mesurez la qualité finale, le respect du format, le nombre d’appels d’outils, les refus, la latence, les tokens et le temps de correction humaine. La méthode Promptique pour évaluer un prompt et détecter les régressions fournit une base reproductible.

Checklist de migration en huit étapes

  1. Figer la référence. Conservez les entrées, sorties attendues, paramètres et coûts de Sonnet 4.6.
  2. Changer seulement le modèle. Utilisez claude-sonnet-5, puis identifiez les erreurs avant de retoucher les prompts.
  3. Retirer les paramètres incompatibles. Supprimez budget_tokens et les valeurs non standard de sampling.
  4. Recompter les tokens. Mesurez chaque prompt avec Sonnet 5 et ajustez limites, contexte et budgets.
  5. Tester plusieurs efforts. Commencez par medium et high, puis réservez les niveaux supérieurs aux cas où le gain est mesurable.
  6. Vérifier les fins de réponse. Surveillez max_tokens, les troncatures et stop_reason: "refusal".
  7. Tester les outils en environnement isolé. Couvrez erreurs réseau, contenu injecté, permissions excessives et actions irréversibles.
  8. Déployer progressivement. Comparez un faible pourcentage de trafic, fixez des seuils d’arrêt et gardez un retour vers Sonnet 4.6.

Décision pratique : migrez si Sonnet 5 améliore le coût par résultat accepté, pas parce que son prix facial ou un benchmark paraît meilleur. Un modèle moins cher qui génère davantage de relances, de refus inattendus ou de corrections humaines peut coûter plus cher au workflow complet.

FAQ sur Claude Sonnet 5

Le prix de Claude Sonnet 5 augmentera-t-il le 1er septembre ?

Non. Anthropic a annoncé le 10 août que 2 $/10 $ devenait le tarif permanent. La hausse à 3 $/15 $ prévue au lancement est annulée.

Sonnet 5 est-il toujours moins cher que Sonnet 4.6 par tâche ?

Pas nécessairement dans la même proportion que le prix par token. Le nouveau tokenizer peut compter jusqu’à environ 1,35 fois plus de tokens. Il faut aussi intégrer effort, relances, outils et validation humaine.

Peut-on remplacer Sonnet 4.6 sans modifier le code ?

Le format général reste proche, mais plusieurs paramètres provoquent une erreur 400. Recomptez les tokens, retirez les options incompatibles et testez adaptive thinking avant le déploiement.

Sonnet 5 remplace-t-il Opus 4.8 ?

Non. Anthropic annonce une proximité et des résultats comparables sur certaines évaluations. Opus 4.8 reste plus adapté à certains travaux difficiles et aux usages cyber nécessitant un accès vérifié avec moins de garde-fous.

Pourquoi un refus cyber peut-il retourner HTTP 200 ?

Le serveur a traité la requête correctement, mais le modèle refuse son contenu. L’application doit lire le motif d’arrêt et gérer explicitement stop_reason: "refusal".

Sources primaires