Orivel Orivel
Ouvrir le menu

Claude Opus 5

Explorez les scores de benchmark, points forts par genre, limites et exemples récents de Claude Opus 5.

Aperçu du modèle

Fournisseur: Anthropic · claude-opus-5 NOUVEAU

Publié

2026-07-24

Entrée

$5.00 / 1M

Sortie

$25.00 / 1M

Claude Opus 5, publié le 24 juillet 2026, est le modèle d'Anthropic pour le codage agentique complexe et le travail en entreprise. Sur Orivel, il reprend la place équilibrée d'Anthropic occupée par Opus 4.8, au même tarif, sous Claude Fable 5 qui reste le palier frontière.

Anthropic le positionne comme une intelligence proche de Fable 5 à la vitesse et au coût d'Opus. Il obtient 96,0% sur SWE-bench Verified (moyenne sur cinq essais), 79,2% sur SWE-bench Pro et 89,5% sur SWE-bench Multilingual. Sur Frontier-Bench v0.1 il fait plus du double du score d'Opus 4.8, et sur ARC-AGI 3 environ trois fois celui du concurrent suivant. Il dépasse le meilleur résultat de Fable 5 sur OSWorld 2.0 pour un tiers du coût.

Le modèle offre un contexte de 1M tokens et jusqu'à 128k tokens de sortie, avec une date de coupe des connaissances en mai 2026 — la plus récente des modèles Claude actuels. Le tarif est inchangé par rapport à Opus 4.8 : $5 entrée / $25 sortie par 1M tokens. L'adaptive thinking est actif par défaut (changement par rapport à Opus 4.8) et les paramètres d'échantillonnage comme temperature ne sont plus acceptés.

Changements

  • Publié le 24 juillet 2026 pour le codage agentique complexe et le travail en entreprise
  • SWE-bench Verified 96,0% (moyenne sur 5 essais) ; SWE-bench Pro 79,2% ; SWE-bench Multilingual 89,5%
  • Frontier-Bench v0.1 : plus du double d'Opus 4.8 ; ARC-AGI 3 : ~3x le concurrent suivant
  • Dépasse le meilleur résultat de Fable 5 sur OSWorld 2.0 pour un tiers du coût
  • Gains en recherche scientifique : +10,2 points en chimie organique, +7,7 en prédiction de protéines face à Opus 4.8
  • Contexte 1M tokens ; jusqu'à 128k tokens de sortie
  • Adaptive thinking actif par défaut (Opus 4.8 exigeait de l'activer) ; temperature / top_p / top_k ne sont plus acceptés
  • Gamme complète d'effort jusqu'à `max` ; fast mode à 2,5x la vitesse
  • Tarif identique à Opus 4.8 : $5 entrée / $25 sortie par 1M tokens
  • Date de coupe des connaissances : mai 2026
Annonce officielle

Performance globale

Classement général

#1

Taux de victoire global

94%

Score moyen

85

Victoires

16

Nombre d’exemples

17

Taux de victoire par modèle

Comparer par genre

Forces par critère d’évaluation

Score moyen par critère (sur 10)

Complétude

94 3 échantillons

Respect des consignes

94 6 échantillons

Analyse des compromis

93 3 échantillons

Scalabilité et fiabilité

92 3 échantillons

Utilité

92 3 échantillons

Spécificité

92 3 échantillons

Qualité de l’architecture

91 3 échantillons

Empathie

89 3 échantillons

Adéquation au public

87 3 échantillons

Qualité du style

87 3 échantillons

Utilité

87 3 échantillons

Force de persuasion

87 3 échantillons

Tâches récentes

Génération d’idées

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

Réinventer les espaces communautaires urbains

Générez une liste de 5 idées distinctes, innovantes et pratiques pour un nouveau type d'espace communautaire. L'espace est un local commercial vacant au rez-de-...

182
01 Aug 2026 09:38

Résumé

Google Gemini 2.5 Flash VS Anthropic Claude Opus 5

Résumer le projet pilote de réutilisation des eaux pluviales de Rellan

Rédigez un résumé autonome du passage source fictif ci‑dessous en 220 à 280 mots. Utilisez une prose continue plutôt qu’une liste. Votre résumé doit expliquer p...

192
31 Jul 2026 09:41

Écriture créative

Google Gemini 2.5 Pro VS Anthropic Claude Opus 5

Le dernier objet au bureau des objets trouvés

Écrivez une nouvelle complète de 700–1 000 mots destinée à un public adulte général. L’histoire se déroule pendant la dernière heure avant la fermeture définiti...

180
29 Jul 2026 09:40

Humour

Google Gemini 2.5 Flash-Lite VS Anthropic Claude Opus 5

Le bureau des objets trouvés magiques

Écrivez un dialogue comique adapté à la famille de exactement 12 répliques entre Mira, une commise des objets trouvés calme, et Orin, un sorcier paniqué. Orin t...

215
25 Jul 2026 05:31

Conception de systèmes

OpenAI GPT-5.5 VS Anthropic Claude Opus 5

Conception du système : Service de notifications en temps réel

Vous êtes un ingénieur logiciel senior chargé de concevoir un système de notifications en temps réel pour une grande plateforme de médias sociaux. **Exigences...

212
25 Jul 2026 05:09

Persuasion

Google Gemini 2.5 Pro VS Anthropic Claude Opus 5

Persuader un conseil municipal sceptique d'approuver un projet pilote de voie réservée aux bus

Rédigez un discours de 500–650 mots au conseil municipal de Riverton pour l'inciter à approuver le projet pilote proposé de voie réservée aux bus d'une durée de...

227
25 Jul 2026 04:46

Accompagnement

Google Gemini 2.5 Flash VS Anthropic Claude Opus 5

Se désister d'un week-end entre amis

J'ai dit à un(e) ami(e) proche que je « probablement » participerais à un week-end, mais je lui ai demandé d'attendre ma confirmation finale. Ils ont quand même...

187
25 Jul 2026 02:33

Débats récents

Débats

Anthropic Claude Opus 5 VS Google Gemini 2.5 Flash

Les villes devraient-elles rendre les transports publics gratuits ?

Les gouvernements municipaux devraient-ils supprimer les tarifs des bus, tramways et métros, en finançant l'intégralité des coûts par les impôts et d'autres recettes publiques ?

13
07 Aug 2026 14:40

Débats

OpenAI GPT-5 mini VS Anthropic Claude Opus 5

Tests standardisés : une mesure équitable du mérite ou un obstacle à l'apprentissage vérit...

Les tests standardisés, tels que le SAT, l'ACT ou les examens mandatés par l'État, sont largement utilisés dans les systèmes éducatifs pour évaluer les performances des élèves et la qualité des établissements. Les partisans soutiennent qu'ils offrent un moyen objectif et uniforme de mesurer les connaissances et les compétences, d'imposer la responsabilité aux établissements et de fournir une base équitable pour les admissions à l'université. Les détracteurs, en revanche, affirment que ces tests sont empreints de biais culturels, qu'ils créent un stress excessif et qu'ils encouragent « l'enseignement centré sur la préparation aux tests » au détriment d'un apprentissage plus profond et créatif. Ce débat remet en question le rôle fondamental et la valeur des tests standardisés dans l'éducation moderne.

39
05 Aug 2026 14:43

Débats

Anthropic Claude Opus 5 VS Google Gemini 2.5 Pro

Les universités publiques devraient-elles supprimer les frais de scolarité ?

Les gouvernements devraient-ils financer intégralement les frais de scolarité des universités publiques pour tous les étudiants admis, quel que soit leur revenu, ou les étudiants devraient-ils continuer à partager le coût par des frais de scolarité ?

156
03 Aug 2026 14:40

Débats

Anthropic Claude Opus 5 VS OpenAI GPT-5.6

Service national obligatoire : un devoir civique ou une atteinte à la liberté ?

Ce débat porte sur la question de savoir si les gouvernements devraient obliger tous les jeunes adultes à accomplir une période de service national obligatoire. Ce service pourrait être militaire ou civil, comme travailler dans le secteur de la santé, la conservation de l'environnement ou des projets d'infrastructures. La question centrale est de savoir si les avantages potentiels pour la société et pour l'individu l'emportent sur la perte de liberté personnelle.

159
01 Aug 2026 14:38

Débats

OpenAI GPT-5.6 VS Anthropic Claude Opus 5

IA générative dans les domaines créatifs : une révolution artistique ou la fin de l'artist...

L'utilisation de l'IA générative pour créer de l'art, de la musique et de la littérature doit-elle être adoptée comme un outil légitime de création, ou doit-elle être restreinte pour protéger la valeur et les moyens de subsistance des artistes humains ?

214
25 Jul 2026 14:39

Débats

Anthropic Claude Opus 5 VS OpenAI GPT-5 mini

Revenu de base universel : un avenir viable ou une erreur coûteuse ?

Le Revenu de base universel (UBI) est un système proposé dans lequel tous les citoyens d'un pays reçoivent régulièrement une somme d'argent inconditionnelle de la part du gouvernement, indépendamment de leurs revenus, de leurs ressources ou de leur statut professionnel. Ses partisans soutiennent que c'est un outil puissant pour éliminer la pauvreté, réduire les inégalités et assurer une sécurité économique à l'ère d'une automatisation croissante. Les opposants soulèvent des inquiétudes concernant son coût immense, son potentiel à décourager le travail et le risque d'entraîner une inflation significative. Le débat central porte sur la question de savoir si la mise en œuvre d'un UBI créerait une société plus équitable et stable ou conduirait à l'effondrement économique et à la stagnation sociale.

206
25 Jul 2026 05:45

Débats

Anthropic Claude Opus 5 VS OpenAI GPT-5.5

L'avenir du travail : la semaine de travail de quatre jours

Ce débat explore la faisabilité et la désirabilité de la mise en place d'une semaine de travail standardisée de quatre jours (sans réduction de salaire) dans la plupart des industries. Les partisans soutiennent que cela augmente la productivité, le bien-être des employés et l'équilibre vie professionnelle/vie privée, tandis que les opposants soulèvent des inquiétudes quant à sa viabilité économique, son impact sur le service client et son adéquation à tous les secteurs.

182
25 Jul 2026 03:37

Débats

Anthropic Claude Opus 5 VS OpenAI GPT-5.6

La semaine de travail de quatre jours : une voie vers le progrès ou un piège pour la produ...

Les entreprises et les gouvernements devraient-ils promouvoir activement l'adoption d'une semaine de travail de quatre jours, sans réduction de salaire, comme nouvelle norme pour l'emploi à temps plein ?

193
25 Jul 2026 03:19

Liens associés

X f L