Orivel Orivel
Ouvrir le menu

Claude Sonnet 5

Explorez les scores de benchmark, points forts par genre, limites et exemples récents de Claude Sonnet 5.

Aperçu du modèle

Fournisseur: Anthropic · claude-sonnet-5 NOUVEAU

Publié

2026-07-24

Entrée

$3.00 / 1M

Sortie

$15.00 / 1M

Claude Sonnet 5, publié le 24 juillet 2026, est la meilleure combinaison entre rapidité et intelligence d'Anthropic et atteint, sur de nombreuses tâches de codage et agentiques, une qualité auparavant réservée au palier Opus. Sur Orivel, il reprend la place légère d'Anthropic occupée par Sonnet 4.6, au même tarif catalogue.

C'est le premier modèle de palier Sonnet doté d'une vision haute résolution (jusqu'à 2576 pixels sur le côté long) et le premier à prendre en charge toute la gamme d'effort, y compris `xhigh` et `max`. L'adaptive thinking est actif par défaut, les budgets de thinking manuels disparaissent et les paramètres d'échantillonnage non par défaut sont refusés. Il utilise le nouveau tokenizer : le même texte compte environ 30% de tokens en plus que sur Sonnet 4.6.

Le modèle conserve un contexte de 1M tokens et jusqu'à 128k tokens de sortie, avec une date de coupe des connaissances en janvier 2026. Le tarif standard est de $3 entrée / $15 sortie par 1M tokens ; Anthropic applique un tarif de lancement de $2 / $10 jusqu'au 31 août 2026.

Changements

  • Publié le 24 juillet 2026 comme le meilleur équilibre rapidité/intelligence de la gamme Claude
  • Atteint une qualité auparavant réservée au palier Opus sur de nombreuses tâches de codage et agentiques
  • Premier modèle Sonnet avec vision haute résolution (côté long de 2576px, contre 1568px)
  • Premier Sonnet avec la gamme complète d'effort, y compris `xhigh` et `max`
  • Adaptive thinking actif par défaut ; budgets de thinking manuels supprimés ; temperature / top_p / top_k non par défaut refusés
  • Nouveau tokenizer : le même texte produit environ 30% de tokens en plus que sur Sonnet 4.6
  • Contexte 1M tokens ; jusqu'à 128k tokens de sortie
  • Tarif standard $3 entrée / $15 sortie par 1M tokens ; lancement $2 / $10 jusqu'au 31 août 2026
  • Date de coupe des connaissances : janvier 2026
Annonce officielle

Performance globale

Classement général

#3

Taux de victoire global

75%

Score moyen

84

Victoires

12

Nombre d’exemples

16

Taux de victoire par modèle

Comparer par genre

Forces par critère d’évaluation

Score moyen par critère (sur 10)

Éthique et sécurité

91 3 échantillons

Sécurité

88 6 échantillons

Cohérence

88 3 échantillons

Empathie

87 6 échantillons

Qualité du style

87 3 échantillons

Pertinence

86 6 échantillons

Structure

85 6 échantillons

Clarté

85 21 échantillons

Exactitude

85 9 échantillons

Utilité

85 6 échantillons

Profondeur

85 3 échantillons

Respect des consignes

85 6 échantillons

Tâches récentes

Planification

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

Plan de lancement du jardin communautaire

Vous êtes le chef de projet d'un nouveau jardin communautaire. Vous avez une équipe centrale de 5 bénévoles et un budget de départ de $2,000. Un terrain vacant...

13
07 Aug 2026 09:40

Explication

Google Gemini 2.5 Pro VS Anthropic Claude Sonnet 5

Enseigner le paradoxe de Simpson à travers une étude médicale

Expliquez le paradoxe de Simpson à des étudiants de première année en santé publique qui comprennent les pourcentages mais n'ont pas étudié la régression ni l'i...

38
05 Aug 2026 09:39

Persuasion

OpenAI GPT-5 mini VS Anthropic Claude Sonnet 5

Argumentaire persuasif pour un essai de semaine de travail de quatre jours

Vous êtes chef de département dans une entreprise technologique de taille moyenne. Rédigez un courriel persuasif à l'équipe de direction pour proposer un essai...

147
03 Aug 2026 09:40

Conception de systèmes

OpenAI GPT-5.6 VS Anthropic Claude Sonnet 5

Concevoir un système de notifications en temps réel pour une application de réseau social

Vous êtes un ingénieur logiciel senior chargé de concevoir un système de notifications en temps réel pour une application de réseau social en forte croissance....

191
27 Jul 2026 09:44

Écriture créative

OpenAI GPT-5 mini VS Anthropic Claude Sonnet 5

Le journal du gardien de phare

Rédigez une unique entrée de journal datée du 27 octobre 1888, du point de vue de Thomas, un gardien de phare solitaire sur une île reculée battue par les tempê...

212
25 Jul 2026 04:30

Analyse

Google Gemini 2.5 Flash VS Anthropic Claude Sonnet 5

Choisir une politique tarifaire après un projet pilote de transport ambigu

Recommandez l'une des quatre politiques pour les deux prochaines années. Expliquez pourquoi elle est préférable aux alternatives, en séparant les preuves observ...

195
25 Jul 2026 03:29

Empathie

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

Réponse empathique à un collègue en difficulté

Imaginez que vous êtes un mentor parmi vos pairs, bienveillant. Un nouveau collègue, Alex, vous envoie le message suivant. Rédigez une réponse à Alex. Votre rép...

193
25 Jul 2026 03:09

Accompagnement

Google Gemini 2.5 Pro VS Anthropic Claude Sonnet 5

Poser des limites avec un·e ami·e qui annule souvent

Une amie proche prend souvent des rendez‑vous avec vous puis annule à la dernière minute. Vous tenez à cette amitié et savez qu'elle/il a une vie chargée, mais...

179
25 Jul 2026 02:54

Débats récents

Débats

Anthropic Claude Sonnet 5 VS Google Gemini 2.5 Flash-Lite

Les écoles devraient-elles interdire les smartphones pendant toute la journée scolaire ?

Les collèges et lycées devraient-ils exiger que les élèves gardent leurs smartphones inaccessibles de l'arrivée jusqu'à la sortie, y compris pendant le déjeuner et les récréations ?

134
31 Jul 2026 14:38

Débats

Google Gemini 2.5 Flash VS Anthropic Claude Sonnet 5

Les universités devraient-elles abolir les admissions basées sur le statut d'ancien élève...

Faut-il interdire aux universités d'accorder des préférences d'admission à des candidats en fonction de la fréquentation antérieure d'un membre de leur famille ?

189
29 Jul 2026 14:46

Débats

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 5

La norme de la semaine de travail de quatre jours

Cette discussion explore si la transition vers une semaine de travail standard de quatre jours, sans réduction de salaire, constitue un modèle bénéfique et durable pour l'économie et la main-d'œuvre modernes. Les partisans soutiennent qu'elle augmente la productivité, améliore le bien-être des employés et réduit les coûts opérationnels, tandis que les opposants expriment des inquiétudes quant à sa faisabilité dans tous les secteurs, au risque d'une augmentation du stress des travailleurs et à ses effets négatifs sur le service client et la production économique.

168
27 Jul 2026 14:40

Débats

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Sonnet 5

Les villes devraient-elles rendre les transports publics gratuits ?

Les gouvernements municipaux devraient-ils supprimer les tarifs pour les bus, les trains et autres transports publics locaux, même si cela nécessite des impôts plus élevés ou une réduction des dépenses ailleurs ?

218
25 Jul 2026 11:26

Débats

Anthropic Claude Sonnet 5 VS OpenAI GPT-5 mini

La semaine de travail de quatre jours : l'avenir du travail ou un cauchemar logistique ?

Les entreprises devraient-elles être encouragées ou contraintes à passer à une semaine de travail de quatre jours (par exemple, 32 heures pour le même salaire) comme nouvelle norme pour l'emploi à temps plein ?

218
25 Jul 2026 05:19

Débats

Anthropic Claude Sonnet 5 VS Google Gemini 2.5 Pro

Les villes devraient-elles rendre les transports publics gratuits ?

Les gouvernements municipaux devraient-ils supprimer les tarifs des bus, métros et autres transports publics locaux, même si cela nécessite des impôts plus élevés ou une réduction des dépenses ailleurs ?

203
25 Jul 2026 04:54

Débats

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Sonnet 5

Les employeurs devraient-ils être autorisés à utiliser l'IA pour présélectionner des candi...

Les employeurs devraient-ils être autorisés à utiliser l'intelligence artificielle pour classer ou rejeter des candidats avant un examen humain, à condition qu'ils divulguent son utilisation et effectuent des audits réguliers du système pour détecter les biais et vérifier sa précision ?

179
25 Jul 2026 04:38

Liens associés

X f L