Claude Sonnet 5 mérite un pilote contrôlé lorsque le travail exige plusieurs appels d’outils, du code et un suivi sur plusieurs étapes. Commencez par des tâches agentiques bornées et du travail de connaissance pour lesquels la capacité d’Opus serait utile, mais dont le coût ou l’accès pose problème. Gardez Sonnet 4.6 ou un modèle supérieur en comparaison si la couverture brute des bugs, la convergence rapide ou un outil spécialisé est prioritaire.
Anthropic a présenté Claude Sonnet 5 le 30 juin 2026. Son ID actuel est claude-sonnet-5. Cet article s’appuie sur l’annonce Anthropic et le catalogue Claude Platform vérifiés le 20 septembre 2026. Le choix ne dépend pas seulement de la nouveauté : l’effort, les outils et la route de fourniture déterminent le coût et le résultat. (Anthropic, Claude Platform)
À retenir
Sonnet 5 est le Sonnet d’Anthropic le plus orienté agents : planification, outils, code et tâches professionnelles en plusieurs étapes.
Le catalogue indique
claude-sonnet-5, la réflexion adaptative, un contexte d’un million de tokens et 128K de sortie maximale. Tous les clients ne montrent pas ces contrôles.La capture API indique 2 dollars en entrée et 10 dollars en sortie par million de tokens. L’effort, les tokens de réflexion et les reprises augmentent le coût par tâche.
Les évaluations publiques sont conditionnelles : Terminal-Bench et le travail de connaissance sont proches d’Opus 4.8, tandis que CodeRabbit observe un compromis précision/rappel en revue de code.
Ce brouillon n’a exécuté aucune tâche Sonnet 5 dans Tabbit et ne contient aucune capture. Vérifiez la fiche Claude Sonnet 5 (English) et votre sélecteur.
Spécifications et accès
| Question | Capture actuelle | Limite de décision |
|---|---|---|
| ID du modèle | claude-sonnet-5 | Conservez l’ID exact dans les journaux. |
| Sortie | 30 juin 2026 | Comparez avec la même tâche et le même environnement. |
| Entrée / sortie | Texte et image / texte | Les outils dépendent de la route. |
| Contexte / sortie max. | 1 million / 128K tokens | Plafonds du catalogue ; le client peut limiter davantage. |
| Réflexion | Adaptative ; effort par défaut high | Comparez les niveaux d’effort. |
| Prix API | 2 / 10 dollars par MTok | Abonnement, cloud et Tabbit sont séparés. |
| Accès | Forfaits Claude et API selon Anthropic | Confirmez compte, région, quota et sélecteur. |
Le catalogue affiche janvier 2026 comme date de connaissances fiables. Ce n’est pas une garantie d’actualité pour un outil connecté. Un navigateur agentique peut agir sur des pages vivantes, mais le modèle ne reçoit pas ces permissions automatiquement.
Ce qui change depuis Sonnet 4.6
Anthropic met en avant les plans longs, les outils de navigateur et de terminal, le code, le raisonnement et le travail de connaissance. L’entreprise dit aussi que les comportements indésirables sont moins fréquents et que les protections cyber sont activées par défaut. Ce sont des affirmations du fournisseur, pas un test Tabbit.
| Dimension | Sonnet 4.6 | Sonnet 5 | Action |
|---|---|---|---|
| Suivi agentique | Base précédente | Davantage de tâches multi-étapes et vérification annoncées | Fixez une condition d’arrêt et une commande de contrôle. |
| Outils | Dépend de la route | Au centre du lancement | Vérifiez les droits et journalisez les appels. |
| Terminal | 67,0 % dans la comparaison datée | 80,4 % sur Terminal-Bench 2.1 | Évaluation publiée, pas une reproduction locale. |
| Travail de connaissance | Base précédente | 1 618 contre 1 615 pour Opus 4.8 | Trois points ne désignent pas un vainqueur général. |
| Revue de code | Environ 63 % de rappel strict, 29 % de précision | Environ 50–51 %, 38–40 % | Choisissez couverture ou commentaires plus nets. |
| Sécurité | Base Sonnet 4.6 | Moins de comportements indésirables selon Anthropic | Gardez revue humaine et tests spécialisés. |
Vellum signale que certaines bases Sonnet 4.6 ont été recalculées. Ne mélangez pas dates, évaluateurs et configurations dans un classement. Les sources de revue Sonnet 5 (English) et le guide de raisonnement agentique donnent le contexte.
Risques encore inconnus
Une évaluation publique n’est pas votre environnement. Endor Labs montre que Sonnet 5 avec Claude Code est solide sur la correction fonctionnelle mais plus faible pour fermer des vulnérabilités. Son résumé indique 83,2 % de FuncPass, tandis que le corps indique 82,6 % ; aucun chiffre n’est donc repris comme fait définitif. Un correctif qui passe les tests fonctionnels n’est pas forcément sécurisé.
L’effort modifie aussi la facture. CodeRabbit n’a pas observé d’amélioration nette du rappel strict en effort élevé, alors que le coût de revue doublait presque. Mesurez tokens de réflexion, reprises, outils et corrections humaines, pas seulement le prix au million.
L’accès est lui aussi propre à la route. Le catalogue ne prouve pas qu’un navigateur ou un fournisseur tiers expose le même modèle et les mêmes outils.
Ce que dit la communauté
Sur Reddit, Exodus_Green estime que Sonnet 4.6 en low effort peut dépasser Sonnet 5 en medium sur la recherche agentique, d’après le graphique publié (commentaire). Rent_South a répété son évaluation de flux logiques cinq fois par modèle et conclut que le choix dépend du flux (même discussion). qubedView juge Sonnet bien moins cher pour l’extraction documentaire en une passe, mais préfère Opus pour le code difficile (discussion). TheRealJesus2 conseille de découper le travail, les petits modèles gérant l’effort bas ou moyen et les grands la planification et la vérification (même discussion).
Ce sont des expériences personnelles, pas des benchmarks. X et YouTube ont été essayés le 20 septembre, sans texte stable et attribuable. Aucune capture n’est inventée ; le brouillon reste bloqué.
Qui devrait l’essayer ?
| Situation | Première étape | Pourquoi |
|---|---|---|
| Extraction, classification ou routage répétitif | Essayer en effort bas/moyen | Les tâches bornées offrent un coût plus prévisible. |
| Code multi-fichiers avec tests | Activer les outils et piloter | Le suivi long est le principal signal positif. |
| Revue de sécurité à haut risque | Garder un modèle spécialisé ou supérieur | La correction fonctionnelle ne ferme pas une vulnérabilité. |
| Petite modification ou chat très sensible à la latence | Comparer Sonnet 4.6 ou un modèle rapide | Il peut trop réfléchir pour une petite tâche. |
| ID absent du sélecteur | Ne pas promettre l’accès ; vérifier compte et région | Le nom du catalogue n’est pas une autorisation. |
L’automatisation du navigateur ne supprime ni authentification, ni limites, ni revue. Pour comparer des produits, utilisez la comparaison des navigateurs IA et le guide des navigateurs IA.
Prochaine étape : mesurer une tâche terminée
Choisissez une tâche réversible, notez l’ID, le client, l’effort, le contexte, les droits, les tokens, le temps, les reprises, les appels d’outils, le résultat indépendant et l’intervention humaine. Lancez le même échantillon de test avec Sonnet 4.6 ou votre modèle actuel. Décidez sur le coût par résultat terminé, pas par token.
Le guide Tabbit Browser présente le flux navigateur et les pratiques Tabbit expliquent comment garder une personne dans la boucle. Aucun test Sonnet 5 n’ayant été exécuté dans Tabbit ici, l’accès n’est pas affirmé.
Verdict final
Claude Sonnet 5 mérite un pilote pour le code agentique, les flux avec outils et le travail de connaissance répétitif. Ce n’est ni un remplacement automatique d’Opus, ni une garantie de sécurité ou d’économie. L’effort, les reprises, la route et le découpage du travail font la différence. Gardez ce texte en brouillon jusqu’au test réel dans Tabbit et aux captures communautaires requises.
Sources
Anthropic — lancement, accès, sécurité et prix.
Claude Platform — ID, contexte, sortie et réflexion.
Prix Claude Platform — référence API.
Endor Labs — évaluation sécurité et limites.
CodeRabbit — évaluation de revue de code.
Vellum — comparaison datée et segmentation des tokens.
Questions fréquentes
Qu’est-ce que Claude Sonnet 5 ?
Claude Sonnet 5 est le modèle intermédiaire d’Anthropic pour le code, les outils, le travail de connaissance et les flux agentiques. Le catalogue Claude Platform vérifié le 20 septembre 2026 indique l’ID claude-sonnet-5, la réflexion adaptative, un contexte d’un million de tokens et une sortie maximale de 128K.
Qu’est-ce qui change par rapport à Sonnet 4.6 ?
Anthropic présente Sonnet 5 comme une version plus agentique, avec des progrès en raisonnement, outils, code et travail professionnel. Des rapports indépendants montrent aussi un compromis : les commentaires de revue peuvent être plus précis, avec une détection stricte des bugs plus faible selon le banc d’essai.
Quelles sont les limites de contexte et de sortie ?
Le catalogue Claude Platform consulté le 20 septembre 2026 indique un contexte d’un million de tokens et une sortie maximale de 128K. Ce sont des limites du catalogue ; le client, le forfait ou le fournisseur peut exposer des limites effectives différentes.
Combien coûte Claude Sonnet 5 ?
La capture actuelle de Claude Platform indique 2 dollars par million de tokens en entrée et 10 dollars en sortie. L’API, les abonnements, le cloud et les majorations de tiers sont séparés, et la réflexion adaptative modifie le coût par tâche.
Où utiliser Claude Sonnet 5 ?
L’annonce d’Anthropic cite les forfaits Claude et l’API Claude. Le sélecteur, la région, le quota et les outils dépendent de la route ; vérifiez le compte réel avant de promettre l’accès à une équipe.
Comment le tester avant de migrer ?
Choisissez une tâche représentative, notez l’ID du modèle, l’effort, les appels d’outils, le temps, les tokens et toute intervention humaine, puis comparez-la à Sonnet 4.6 ou au modèle actuel. Une seule réussite ne prouve pas la fiabilité en production.