Claude Sonnet 5 : on a testé le nouveau modèle par défaut d’Anthropic (avis 2026)
Anthropic a mis en ligne Claude Sonnet 5 le 30 juin 2026. Trois semaines de tests plus tard, un constat s’impose : c’est le premier Sonnet qui rend Opus 4.8 optionnel pour la majorité des usages quotidiens. Le modèle est disponible par défaut sur Claude Free et Pro, il gère 1 million de tokens de contexte en natif et surtout, jusqu’au 31 août 2026, son tarif API est bloqué à $2 / $10 par million de tokens en entrée/sortie — soit 40 à 60 % moins cher qu’Opus.
Ce test couvre cinq cas réels (raisonnement long, rédaction française structurée, code Python, résumé de PDF, conversation multi-tour), le face-à-face avec Opus 4.8 et GPT-5.6 Terra, le calcul rapport qualité/prix pendant la fenêtre intro, et les limites qu’il faut connaître avant de basculer.
Le verdict en 30 secondes
| Critère | Note /5 | Commentaire |
|---|---|---|
| Raisonnement long | 4,5 | Termine les tâches multi-étapes sans qu’on ait à relancer |
| Écriture française | 4 | Structure propre, syntaxe soignée, moins de tics de langage que GPT-5.6 |
| Code (Python, JS) | 4 | Progresse nettement sur Terminal-Bench, reste derrière Opus 4.8 sur SWE-bench Pro |
| Prix (fenêtre intro) | 5 | $2 / $10 jusqu’au 31/08 : imbattable à ce niveau de qualité |
| Contexte 1M tokens | 5 | Natif, pas de flag beta, pas de surcoût |
Verdict tranché : à ce tarif intro, Sonnet 5 devient le modèle par défaut pour 80 % des cas — rédaction, analyse, code métier. Passez à Opus 4.8 uniquement pour du code très complexe (SWE-bench Pro) ou du raisonnement mathématique de niveau olympiade. GPT-5.6 Terra joue dans la même cour tarifaire mais reste plombé par le caveat METR sur les benchmarks.
Claude Sonnet 5 c’est quoi exactement
Sonnet 5 succède à Sonnet 4.6 dans la gamme Anthropic. Deux différences structurelles : la fenêtre de contexte passe à 1 million de tokens en natif (soit environ 555 000 mots) et la sortie maximale double à 128K tokens. Le mode « adaptive thinking » est activé par défaut — inutile d’appeler manuellement l’extended thinking, l’API renvoie une erreur 400 si vous essayez.
Le positionnement dans la gamme : Sonnet est le fer de lance quotidien d’Anthropic, Opus 4.8 reste réservé aux tâches lourdes (grosse ingénierie logicielle, raisonnement mathématique poussé), et Claude Fable 5 vise la frontière recherche. Sur Claude Free et Pro, Sonnet 5 est le modèle par défaut depuis le 30 juin. Sur Max, Team et Enterprise, il est activable dans le sélecteur de modèle.
Point d’attention pour les développeurs : le tokenizer a été mis à jour. Le même texte peut mapper à 1,0 – 1,35× plus de tokens qu’avec Sonnet 4.6. Le calcul de coût à budget iso n’est donc pas mécanique — il faut re-mesurer sur vos prompts réels.
Notre test sur 5 cas réels
Cas 1 — Raisonnement multi-étapes (audit d’un contrat SaaS de 42 pages). Le prompt demande d’extraire les clauses de résiliation, les pénalités, les zones grises RGPD, et de produire un tableau de recommandations. Sonnet 5 traite le document en une seule requête grâce au contexte 1M, sort une synthèse structurée en 4 sections et cite les paragraphes sources. Il vérifie de lui-même trois incohérences entre l’annexe tarifaire et l’article 7 — sans qu’on l’ait demandé. Sonnet 4.6 s’arrêtait à l’extraction brute.
Cas 2 — Rédaction française structurée (article de 1 800 mots sur un sujet technique). Prompt volontairement flou : « rédige un guide pratique sur la mise en place d’un pipeline CI/CD pour une équipe de 4 devs ». Le résultat est propre, syntaxe correcte, transitions logiques, moins de formules creuses que sur Sonnet 4.6. Deux passages restent un peu académiques — pas rédhibitoire, corrigés en 5 minutes.
Cas 3 — Code Python (parser JSON imbriqué + tests unitaires). Sonnet 5 produit un parser récursif propre, propose de lui-même 12 cas de tests unitaires (edge cases inclus : nulls, listes vides, clés dupliquées). Le code passe sans modification. Sur un cas plus tordu (refactoring d’une classe de 400 lignes avec des dépendances circulaires), Opus 4.8 reste plus solide.
Cas 4 — Résumé d’un rapport financier PDF de 180 pages. La force du contexte 1M s’exprime pleinement : chargement complet en une passe, résumé structuré en 3 niveaux (exécutif, chapitres, chiffres-clés), avec citations de pages. Aucun oubli sur le test — les 3 sections que j’avais volontairement placées en fin de document sont bien restituées.
Cas 5 — Conversation multi-tour (30 échanges sur la conception d’un feature produit). Cohérence sur toute la longueur, se souvient des contraintes énoncées 20 tours plus tôt, propose des trade-offs sans qu’on les demande. Sur ce genre d’exercice, la différence avec Sonnet 4.6 est nette : moins de rappels nécessaires, moins de dérive de ton.
Bilan du test : Sonnet 5 tient la promesse « plus agentique » sans exiger de prompts plus longs. Le gain est visible dès la première utilisation intensive.
Sonnet 5 vs Opus 4.8 vs GPT-5.6 Terra : le vrai calcul rapport qualité/prix
| Modèle | Prix input | Prix output | Contexte | Cas d’usage idéal |
|---|---|---|---|---|
| Claude Sonnet 5 (intro, jusqu’au 31/08) | $2 / M |
$10 / M |
1M | Rédaction, analyse doc long, code métier, agents |
| Claude Sonnet 5 (standard post-31/08) | $3 / M |
$15 / M |
1M | Idem, avec plafond de coût légèrement plus haut |
| Claude Opus 4.8 | $5 / M |
$25 / M |
1M | Code très complexe, maths olympiade, computer use |
| GPT-5.6 Terra | $2,50 / M |
$15 / M |
1M | Raisonnement, code — attention caveat METR benchmark-gaming |
| GPT-5.6 Sol (flagship) | $5 / M |
$30 / M |
1M | Tâches lourdes, mais plus cher qu’Opus 4.8 |
Sur les 11 benchmarks partagés entre Sonnet 5 et Opus 4.8, Sonnet gagne Terminal-Bench 2.1, égalise HLE (avec outils), et perd 9 autres — mais 7 des 9 déficits sont sous 6 points. Le seul écart large : USAMO (maths olympiade), 17 points de retard.
En pratique : pour de la rédaction, de l’analyse et du code métier, la qualité perçue est équivalente à Opus 4.8. Le coût, lui, est divisé par 2,5 pendant la fenêtre intro et par 1,67 après. Face à GPT-5.6 Terra au tarif similaire, Sonnet 5 marque des points sur la rédaction française (moins de tics anglophones) et sur la transparence des benchmarks — un point sur lequel notre avis GPT-5.5 reste la meilleure référence en attendant notre test complet de GPT-5.6.
Pour un développeur qui veut arbitrer entre modèles selon la tâche, notre guide comparatif ChatGPT vs Claude et le face-à-face Opus 4.8 vs Gemini 3.5 donnent les autres axes de comparaison.
Prix, disponibilité France et plans Free/Pro/Team
API (tarif intro jusqu’au 31 août 2026) : $2 / M input, $10 / M output. Cache reads : $0,20 / M. Cache writes 5 min : $2,50 / M. Batch API : 50 % de réduction. Passage au tarif standard $3 / $15 le 1er septembre 2026.
Claude Free : Sonnet 5 est le modèle par défaut, avec les quotas Free habituels (limites de messages par 5h, reset horaire). Aucune action à faire, l’ancien modèle a basculé automatiquement pour tous les comptes.
Claude Pro (20 € / mois) : Sonnet 5 par défaut, quotas 5× supérieurs à Free, accès aux Projects, à Claude Code CLI et à Claude Cowork (notre test complet de Claude Cowork détaille ce que le mode ajoute). Utilisable sur l’app iOS/Android FR sans friction.
Claude Max (100 € / mois ou 200 € / mois) : Sonnet 5 + Opus 4.8 sans quota strict, priorité serveur, contexte 1M sur toutes les tâches. C’est le plan à envisager si vous consommez plus de 30M tokens/mois et que vous voulez arbitrer Sonnet 5 / Opus 4.8 à la tâche.
Team et Enterprise : Sonnet 5 disponible par défaut, plus les fonctions admin (SSO, audit logs, provisioning). Le pricing dépend du volume négocié.
RGPD : Anthropic reste basé US mais dispose désormais de traitements EU pour Claude Enterprise (Data Processing Addendum signé, DPA public). Pour Claude Free et Pro, le traitement reste US — à évaluer selon votre cas d’usage. Sans compte, l’accès reste possible via des interfaces intermédiaires — notre page Claude AI gratuit recense les options actuelles.
Les limites qu’il faut connaître
Latence en pic. Aux heures européennes de forte charge (14h-18h CEST), on a mesuré des temps de première réponse jusqu’à 4,5 secondes sur des prompts longs — contre 2 secondes en heures creuses. Rien de bloquant, mais si vous streamez du contenu en front, prévoyez le buffer.
Coût réel post-intro. Le calcul rapport qualité/prix change au 1er septembre 2026. À $3 / $15, Sonnet 5 reste très compétitif face à Opus 4.8 ($5 / $25), mais le gap avec GPT-5.6 Terra ($2,50 / $15) se resserre côté input. Si votre workload est majoritairement input-heavy (documents longs, contexte massif), refaites le calcul début septembre.
Tokenizer changé. À budget iso, vos prompts existants peuvent consommer jusqu’à 35 % de tokens en plus qu’avec Sonnet 4.6. Ce n’est pas un bug, c’est un changement de tokenisation qui améliore la performance mais casse le calcul de coût mécanique. Mesurez sur vos vrais prompts avant de re-budgéter.
Sampling verrouillé. L’API renvoie une erreur 400 si vous passez une temperature ou un top_p non par défaut. C’est un choix produit d’Anthropic pour garantir la reproductibilité, mais si vos pipelines s’appuyaient sur du sampling créatif, il faut adapter.
MCP et outils tiers. Sonnet 5 fonctionne parfaitement avec le protocole MCP et les outils Claude Code. Pour choisir un abonnement adapté à un usage mixte modèles + outils, notre comparatif des abonnements IA 2026 décrit les seuils utiles.
FAQ
Sonnet 5 est-il disponible dans Claude Pro ? Oui, c’est le modèle par défaut depuis le 30 juin 2026, sans action à faire. Les quotas Pro s’appliquent (5× ceux de Free).
Comment activer Sonnet 5 sans compte ? L’accès direct via claude.ai exige un compte gratuit. Pour tester sans inscription, il faut passer par des interfaces tierces (voir notre page Claude AI gratuit) ou via l’API en mode évaluation.
Le tarif intro $2 / $10 est-il pour tout le monde ? Oui, il s’applique à tous les utilisateurs API sans distinction jusqu’au 31 août 2026 à 23h59 UTC. Après cette date, le tarif standard $3 / $15 prend effet automatiquement.
Quand payer Opus 4.8 plutôt que Sonnet 5 ? Trois cas : gros refactoring code (SWE-bench Pro, Opus 4.8 mène de 6 points), maths de haut niveau (USAMO, écart de 17 points), et computer use en production (OSWorld, Opus 4.8 devant). Pour tout le reste, Sonnet 5 fait le job à moitié prix.
Claude Sonnet 5 est-il compatible RGPD pour un usage professionnel en France ? Le DPA Anthropic Enterprise couvre le traitement EU. Pour Free et Pro, le traitement reste US — évaluez selon votre exposition et votre secteur. Une signature DPA est possible sur Team et Enterprise.
