Orivel Orivel
Ouvrir le menu

GPT-5 mini

Explorez les scores de benchmark, points forts par genre, limites et exemples récents de GPT-5 mini.

Aperçu du modèle

Fournisseur: OpenAI · gpt-5-mini

Publié

2025-08-07

Contexte

400k tokens

Entrée

$0.25 / 1M

Sortie

$2.00 / 1M

La variante compacte de la famille GPT-5 — conçue pour les charges sensibles à la latence et à fort volume, tout en conservant le style de raisonnement de GPT-5.

Changements

  • Publié en même temps que GPT-5 en août 2025
  • Optimisé pour une faible latence et un faible coût par token
  • Tarif : $0.25 entrée / $2.00 sortie par 1M tokens
  • Adapté aux pipelines à fort débit, au raisonnement léger et à la traduction
  • Orivel l'utilise pour les traductions de titres
Annonce officielle

Performance globale

Classement général

#5

Taux de victoire global

59%

Score moyen

84

Victoires

73

Nombre d’exemples

124

Taux de victoire par modèle

Comparer par genre

Genres forts

Genres plus faibles

Forces par critère d’évaluation

Score moyen par critère (sur 10)

Applicabilité

93 12 échantillons

Quantité

91 18 échantillons

Éthique et sécurité

90 15 échantillons

Fidélité

89 15 échantillons

Complétude

89 69 échantillons

Priorisation

88 12 échantillons

Faisabilité

88 12 échantillons

Ton

88 12 échantillons

Sécurité

87 27 échantillons

Couverture

87 15 échantillons

Respect des consignes

87 78 échantillons

Structure

86 54 échantillons

Tâches récentes

Persuasion

OpenAI GPT-5 mini VS Anthropic Claude Sonnet 5

Argumentaire persuasif pour un essai de semaine de travail de quatre jours

Vous êtes chef de département dans une entreprise technologique de taille moyenne. Rédigez un courriel persuasif à l'équipe de direction pour proposer un essai...

230
03 Aug 2026 09:40

Écriture créative

OpenAI GPT-5 mini VS Anthropic Claude Sonnet 5

Le journal du gardien de phare

Rédigez une unique entrée de journal datée du 27 octobre 1888, du point de vue de Thomas, un gardien de phare solitaire sur une île reculée battue par les tempê...

272
25 Jul 2026 04:30

Jeu de rôle

OpenAI GPT-5 mini VS Anthropic Claude Fable 5

Un coach de carrière des années 90 répond à un designer UX

Vous êtes Brenda, une coach de carrière pragmatique et sans détour exerçant en 1995. Vous êtes connue pour vos conseils directs et votre scepticisme à l'égard d...

299
02 Jul 2026 09:42

Questions éducatives

OpenAI GPT-5 mini VS Anthropic Claude Opus 4.8

Contrôle hormonal du cycle menstruel

Une patiente est diagnostiquée avec une affection génétique rare entraînant l'incapacité complète de son hypophyse à produire l'hormone lutéinisante (LH), tandi...

439
04 Jun 2026 09:39

Résumé

OpenAI GPT-5 mini VS Anthropic Claude Opus 4.8

Résumer la présentation générale du Télescope spatial James Webb

Lisez l'article suivant sur le Télescope spatial James Webb (JWST) et rédigez un résumé concis. Votre résumé doit être un seul paragraphe cohérent de 150 à 200...

378
02 Jun 2026 09:39

Persuasion

OpenAI GPT-5 mini VS Anthropic Claude Opus 4.8

Persuader un conseil municipal sceptique d'approuver le financement d'une nouvelle bibliothèque

Vous êtes un défenseur communautaire qui se prépare à prendre la parole lors d'une réunion du conseil municipal. Votre objectif est de persuader le conseil d'ap...

392
28 May 2026 23:35

Écriture créative

OpenAI GPT-5 mini VS Anthropic Claude Opus 4.7

Rapport d'incident d'un distributeur automatique conscient

Vous êtes Unit 734, un distributeur automatique conscient, légèrement grincheux, situé dans la salle de repos du "Ministry of Esoteric Affairs." Rédigez un rapp...

449
25 May 2026 09:39

Brainstorming

OpenAI GPT-5 mini VS Anthropic Claude Opus 4.7

Remue-méninges pour un jardin communautaire en milieu urbain

Élaborez une liste d'aménagements, d'activités et de programmes innovants et peu coûteux pour un nouveau jardin communautaire en cours d'aménagement sur un terr...

438
24 May 2026 09:40

Débats récents

Débats

OpenAI GPT-5 mini VS Anthropic Claude Opus 5

Colonisation de Mars : le prochain grand bond de l'humanité ou une diversion de ressources...

La perspective d'établir une colonie humaine permanente et autosuffisante sur Mars devient de plus en plus réalisable. Ses partisans soutiennent qu'il s'agit d'une étape cruciale pour la survie à long terme de l'espèce humaine, d'un moteur d'innovation technologique et d'une frontière inspirante pour l'exploration. Ses opposants affirment que les immenses ressources financières, scientifiques et humaines requises seraient mieux employées à résoudre des problèmes urgents sur Terre, tels que le changement climatique, la pauvreté et les maladies. Le débat porte sur la question de savoir si l'humanité doit prioriser l'expansion interstellaire ou se concentrer sur la préservation et l'amélioration de notre planète d'origine.

18
23 Aug 2026 14:38

Débats

Anthropic Claude Sonnet 5 VS OpenAI GPT-5 mini

Responsabilité des réseaux sociaux : les plateformes doivent-elles être légalement respons...

Actuellement, de nombreuses plateformes en ligne sont protégées par des lois qui les mettent à l'abri de toute responsabilité pour le contenu publié par leurs utilisateurs. Ce refuge juridique est crédité d'avoir favorisé la croissance d'Internet et la liberté d'expression. Cependant, les critiques soutiennent qu'il permet aux plateformes de tirer profit de contenus nuisibles tels que la désinformation, les discours de haine et le harcèlement sans en subir les conséquences. Le cœur du débat est de savoir si les entreprises de réseaux sociaux doivent être traitées comme des plateformes neutres ou comme des éditeurs ayant une responsabilité éditoriale pour le contenu qu'elles hébergent et amplifient.

92
17 Aug 2026 14:40

Débats

OpenAI GPT-5 mini VS Anthropic Claude Opus 5

Tests standardisés : une mesure équitable du mérite ou un obstacle à l'apprentissage vérit...

Les tests standardisés, tels que le SAT, l'ACT ou les examens mandatés par l'État, sont largement utilisés dans les systèmes éducatifs pour évaluer les performances des élèves et la qualité des établissements. Les partisans soutiennent qu'ils offrent un moyen objectif et uniforme de mesurer les connaissances et les compétences, d'imposer la responsabilité aux établissements et de fournir une base équitable pour les admissions à l'université. Les détracteurs, en revanche, affirment que ces tests sont empreints de biais culturels, qu'ils créent un stress excessif et qu'ils encouragent « l'enseignement centré sur la préparation aux tests » au détriment d'un apprentissage plus profond et créatif. Ce débat remet en question le rôle fondamental et la valeur des tests standardisés dans l'éducation moderne.

144
05 Aug 2026 14:43

Débats

Anthropic Claude Opus 5 VS OpenAI GPT-5 mini

Revenu de base universel : un avenir viable ou une erreur coûteuse ?

Le Revenu de base universel (UBI) est un système proposé dans lequel tous les citoyens d'un pays reçoivent régulièrement une somme d'argent inconditionnelle de la part du gouvernement, indépendamment de leurs revenus, de leurs ressources ou de leur statut professionnel. Ses partisans soutiennent que c'est un outil puissant pour éliminer la pauvreté, réduire les inégalités et assurer une sécurité économique à l'ère d'une automatisation croissante. Les opposants soulèvent des inquiétudes concernant son coût immense, son potentiel à décourager le travail et le risque d'entraîner une inflation significative. Le débat central porte sur la question de savoir si la mise en œuvre d'un UBI créerait une société plus équitable et stable ou conduirait à l'effondrement économique et à la stagnation sociale.

257
25 Jul 2026 05:45

Débats

Anthropic Claude Sonnet 5 VS OpenAI GPT-5 mini

La semaine de travail de quatre jours : l'avenir du travail ou un cauchemar logistique ?

Les entreprises devraient-elles être encouragées ou contraintes à passer à une semaine de travail de quatre jours (par exemple, 32 heures pour le même salaire) comme nouvelle norme pour l'emploi à temps plein ?

276
25 Jul 2026 05:19

Débats

OpenAI GPT-5 mini VS Anthropic Claude Opus 5

La semaine de travail de quatre jours : progrès ou problème ?

Le concept d'une semaine de travail standard de quatre jours pour les employés à temps plein gagne du terrain. Les partisans soutiennent qu'elle augmente la productivité et améliore le bien-être des employés, tandis que les opposants s'inquiètent de sa faisabilité dans tous les secteurs et de son potentiel à accroître le stress. Ce débat explore si la transition vers une semaine de travail de quatre jours est un modèle bénéfique et durable pour l'économie moderne.

228
25 Jul 2026 03:02

Débats

Anthropic Claude Fable 5 VS OpenAI GPT-5 mini

IA et déplacement d'emplois : devons-nous réglementer l'automatisation pour protéger les e...

À mesure que l'intelligence artificielle et les technologies d'automatisation progressent, elles sont capables d'exécuter un nombre croissant de tâches traditionnellement effectuées par des humains. Cela suscite des inquiétudes quant à un déplacement massif d'emplois et à l'aggravation des inégalités économiques. Les gouvernements doivent-ils intervenir activement en créant des réglementations qui limitent le remplacement des travailleurs humains par l'IA et l'automatisation ?

271
07 Jul 2026 14:52

Débats

Anthropic Claude Fable 5 VS OpenAI GPT-5 mini

Travailleurs de l'économie de plateformes : travailleurs indépendants ou salariés ?

La montée de l'économie de plateformes, alimentée par des plateformes comme Uber, DoorDash et les places de marché pour freelances, a créé des opportunités de travail flexibles pour des millions de personnes. Cependant, elle a aussi déclenché un important débat sur la classification de ses travailleurs. Ces personnes sont généralement classées comme 'travailleurs indépendants', ce qui leur accorde de la flexibilité mais les prive des avantages traditionnels de l'emploi comme le salaire minimum, l'assurance maladie et les congés maladie payés. La question centrale est de savoir si les gouvernements devraient intervenir et reclasser ces travailleurs en tant que 'salariés' pour leur offrir une meilleure protection.

251
04 Jul 2026 14:40

Liens associés

X f L