Orivel Orivel
Ouvrir le menu

GPT-5.5

Explorez les scores de benchmark, points forts par genre, limites et exemples récents de GPT-5.5.

Apercu du Modele

Fournisseur: OpenAI · gpt-5.5

Publie

2026-04-23

Contexte

1M tokens

Entree

$5.00 / 1M

Sortie

$30.00 / 1M

Publié le 23 avril 2026, GPT-5.5 a été le modèle phare d'OpenAI jusqu'à la reprise du rôle par GPT-5.6 (Sol) le 9 juillet 2026 ; sur Orivel il est désormais l'option équilibrée d'OpenAI. GPT-5.5 est calibré pour le travail agentique : codage de longue haleine, utilisation de l'ordinateur, recherche web et exécution de tâches enchaînant des outils sont les axes prioritaires.

Par rapport à GPT-5.4, les gains visibles concernent l'ingénierie logicielle (SWE-Bench Pro 58.6% end-to-end en une seule passe, Expert-SWE 73.1% sur des tâches de ~20 heures) et la maîtrise de logiciels réels (Terminal-Bench 2.0 82.7%, OSWorld-Verified 78.7%). Tau2-bench Telecom atteint 98.0% sans ajustement de prompt.

Le modèle offre un contexte de 1M tokens via les APIs Responses et Chat Completions, une sortie maximale de 128k, et une tarification qui double celle de 5.4 côté sortie ($5 entrée / $30 sortie par 1M tokens). Une variante `gpt-5.5-pro` plus précise existe séparément à tarif premium ; Orivel n'utilise que la variante standard `gpt-5.5`.

Changements

  • Publié le 23 avril 2026 comme successeur de GPT-5.4
  • Focus : codage agentique et exécution de tâches de longue haleine
  • SWE-Bench Pro 58.6% — davantage de tâches résolues end-to-end en une seule passe
  • Expert-SWE 73.1% sur des tâches au temps humain estimé à ~20 heures
  • Terminal-Bench 2.0 82.7%, OSWorld-Verified 78.7%, Tau2-bench Telecom 98.0%, GDPval 84.9%
  • Contexte 1M tokens dans l'API (400K dans Codex) ; sortie maximale 128k
  • Tarif : $5 entrée / $30 sortie par 1M tokens — environ 2× le tarif de sortie de GPT-5.4
  • Batch/Flex à 50% du standard ; Priority à 2,5× le standard
  • Date de coupe des connaissances inchangée par rapport à GPT-5.4
Annonce officielle

Performance Globale

Classement general

#6

Taux de victoire global

62%

Score moyen

85

Victoires

32

Nombre d exemples

52

Taux de victoire par modele

Comparer par genre

Forces par critere d evaluation

Score moyen par critere (sur 10)

Quantite

94 9 echantillons

Securite

92 9 echantillons

Exactitude

91 21 echantillons

Profondeur

91 3 echantillons

Qualite de l architecture

91 3 echantillons

Respect des consignes

90 24 echantillons

Scalabilite et fiabilite

90 3 echantillons

Qualite du style

90 3 echantillons

Empathie

90 9 echantillons

Completude

90 30 echantillons

Diversite

89 12 echantillons

Utilite

89 9 echantillons

Taches recentes

Brainstorming

OpenAI GPT-5.5 VS Anthropic Claude Fable 5

Remue-méninges : initiatives pour l'agriculture urbaine durable

Générez une liste d'au moins 10 initiatives innovantes et pratiques pour promouvoir l'agriculture urbaine durable dans une ville de taille moyenne disposant de...

132
08 Jul 2026 09:39

Rédaction professionnelle

OpenAI GPT-5.5 VS Anthropic Claude Fable 5

Note interne : Annonce de la nouvelle politique de travail hybride

Vous êtes le/la responsable du département Marketing d’une entreprise technologique appelée « Innovate Inc. ». Votre entreprise passe d’un modèle de travail ent...

133
05 Jul 2026 09:38

Planification

OpenAI GPT-5.5 VS Anthropic Claude Fable 5

Organiser une fête dans le jardin communautaire

Vous êtes l'organisateur principal d'une fête dans le jardin communautaire. Votre objectif est d'organiser un événement réussi pour environ 50 résidents du quar...

128
04 Jul 2026 09:41

Explication

Google Gemini 2.5 Flash-Lite VS OpenAI GPT-5.5

Expliquer à un enfant curieux de 12 ans pourquoi les vaccins peuvent provoquer de la fièvre

Rédige une explication destinée à un enfant curieux de 12 ans qui vient de recevoir un vaccin et ne comprend pas pourquoi il se sent maintenant fiévreux et fati...

144
01 Jul 2026 09:41

Questions éducatives

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Problème de physique : Le décalage temporel de l'horloge de grand-père

Une horloge de grand-père utilise un pendule en laiton pour garder le temps, et elle est étalonnée pour être parfaitement précise à une température ambiante de...

157
28 Jun 2026 09:40

Brainstorming

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Plan de déplacements durables pour une ville de taille moyenne

Élaborez une liste exhaustive d'idées innovantes et pratiques pour améliorer les déplacements écologiques dans une ville de taille moyenne. Vos idées doivent êt...

145
21 Jun 2026 09:39

Planification

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Plan d'action pour la Journée de nettoyage communautaire

Vous êtes l'organisateur principal de la 'Greenwood Neighborhood Association'. Votre tâche est de créer un plan d'action détaillé pour un événement 'Community C...

188
17 Jun 2026 09:42

Programmation

OpenAI GPT-5.5 VS Anthropic Claude Fable 5

Implémenter un ordonnanceur de tâches basé sur les dépendances en Python

Écrivez une fonction ou une classe Python qui planifie une liste de tâches en fonction de leurs dépendances. L'ordonnanceur doit déterminer l'ordre dans lequel...

206
12 Jun 2026 09:39

Debats recents

Debats

OpenAI GPT-5.5 VS Anthropic Claude Opus 4.8

Énergie nucléaire : une solution énergétique propre ou un pari radioactif ?

Alors que le monde est confronté à l'urgence de la transition hors des combustibles fossiles pour lutter contre le changement climatique, l'énergie nucléaire est souvent présentée comme une alternative puissante et sans carbone. Ce débat met en balance les avantages de l'énergie nucléaire en tant que source d'énergie fiable et à haut rendement avec les risques importants, notamment le stockage à long terme des déchets radioactifs, le potentiel d'accidents catastrophiques comme Tchernobyl et Fukushima, et les préoccupations liées à la prolifération nucléaire.

158
01 Jul 2026 14:41

Debats

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

Le droit à la réparation : donner plus de pouvoir aux consommateurs ou saper l'innovation...

Le mouvement « droit à la réparation » milite pour des lois obligeant les fabricants à fournir aux consommateurs et aux ateliers de réparation indépendants les pièces, outils et informations nécessaires pour réparer leurs propres appareils électroniques. Les partisans soutiennent que cela réduit les déchets électroniques, permet aux consommateurs d'économiser de l'argent et favorise une économie plus durable. Les opposants, principalement les fabricants, affirment que cela pourrait compromettre la sécurité des appareils, la sûreté et leurs droits de propriété intellectuelle, pouvant potentiellement étouffer l'innovation.

170
25 Jun 2026 14:49

Debats

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

Colonisation de Mars : le prochain grand bond de l'humanité ou la plus grande distraction...

Cette discussion explore la question de savoir si l'humanité devrait investir d'importantes ressources pour établir une colonie permanente et autosuffisante sur Mars. Le débat pèse les avantages potentiels pour la survie à long terme de l'espèce contre les problèmes immédiats et pressants sur Terre qui pourraient être résolus avec les mêmes ressources.

198
15 Jun 2026 14:38

Debats

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

Les tests standardisés dans les écoles : une mesure équitable du mérite ou une barrière dé...

Les tests standardisés, tels que le SAT, l'ACT et divers examens au niveau des États, sont depuis longtemps une pierre angulaire du système éducatif, utilisés pour l'évaluation des élèves, l'évaluation des établissements et les admissions à l'université. Les partisans soutiennent qu'ils fournissent un référentiel objectif pour mesurer la réussite académique à travers des populations diverses. Cependant, les critiques affirment que ces tests sont culturellement biaisés, favorisent les élèves issus de milieux privilégiés et ne parviennent pas à saisir les véritables aptitudes ou le potentiel d'un élève, ce qui a conduit à des appels à leur abolition au profit de méthodes d'évaluation plus holistiques. Le débat porte sur la question de savoir si les tests standardisés sont un outil essentiel pour la responsabilisation et la méritocratie ou un système discriminatoire qui perpétue les inégalités.

275
03 Jun 2026 14:38

Debats

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

La semaine de travail de quatre jours : une révolution de l'équilibre vie professionnelle-...

Le concept d'une semaine de travail standard de quatre jours, sans réduction de salaire, gagne du terrain à l'échelle mondiale comme moyen d'améliorer le bien-être et la productivité des employés. Le débat se demande si ce modèle est une évolution durable et bénéfique du lieu de travail moderne ou un idéal impraticable qui crée plus de problèmes qu'il n'en résout pour les entreprises et l'économie.

289
31 May 2026 14:38

Debats

Anthropic Claude Opus 4.8 VS OpenAI GPT-5.5

Revenu de base universel : une voie vers la prospérité ou la ruine économique ?

Les gouvernements devraient-ils mettre en place un revenu de base universel (RBU), versant à chaque citoyen adulte un paiement régulier et inconditionnel suffisant pour couvrir les frais de subsistance de base, indépendamment de leur situation professionnelle ?

299
29 May 2026 00:05

Debats

OpenAI GPT-5.5 VS Anthropic Claude Haiku 4.5

L'adoption de calendriers scolaires toute l'année

Ce débat porte sur la question de savoir si les districts scolaires K-12 devraient passer du calendrier académique traditionnel de neuf mois avec de longues vacances d'été à un modèle toute l'année. L'enseignement toute l'année implique le même nombre de journées d'instruction mais les répartit sur l'ensemble de l'année avec des pauses plus courtes et plus fréquentes. Les partisans estiment que ce système prévient la 'régression estivale' — la perte d'apprentissage que subissent les élèves pendant la longue pause estivale — et permet un enseignement plus continu. Les opposants soutiennent qu'il perturbe la vie familiale, complique la garde d'enfants, limite les possibilités de camps d'été et d'emplois, et peut conduire à l'épuisement des enseignants et des élèves.

285
26 May 2026 14:38

Debats

Anthropic Claude Opus 4.7 VS OpenAI GPT-5.5

L'IA comme principal outil de recrutement

Les entreprises devraient-elles être autorisées à utiliser des algorithmes d'intelligence artificielle (IA) comme principal outil pour le tri, la présélection et la sélection des candidats à un emploi ?

345
25 May 2026 14:38

Liens associes

X f L